QI ZHI · AI 能力起点

先认识 AI,
再决定让它帮你做什么。

AI 不是一个神秘的万能按钮,而是一组各有所长的工具。先了解文字、图片、视频和多模态模型能做什么、有什么优势和边界,再从一个真实任务开始。

AI 学习起步

从模型认知开始,知道什么任务适合什么工具。

给第一次接触 AI 的你:不用一次学会所有模型。先选一个真实的小任务,再根据任务选择文字、图片、视频或多模态工具。AI 给出的内容要核对事实、版权、隐私和专业风险。

文字类大模型

适合对话、写作、总结、翻译、分析、方案和代码。
优势:整理信息和表达效率高。
边界:可能编造事实,重要数据必须核验。

图片类大模型

适合生成图片、修图、商品视觉、封面和海报构思。
优势:快速探索构图、色彩和视觉方向。
边界:人物手部、文字、商标和细节一致性要检查。

视频类大模型

适合视频生成、图生视频、广告和短视频创意。
优势:降低拍摄门槛,快速验证镜头和叙事。
边界:必须写清主体连续、动作因果和时长。

多模态大模型

可以同时理解文字、图片、文件和声音。
优势:减少来回描述,适合看图、资料和视频分析。
边界:看见不等于事实确认,专业事项仍需人工判断。

常用工具怎么选

不是排名,而是按任务匹配;模型版本和平台政策以官方页面为准。

豆包

图文视频多模态

中文交互自然,适合普通用户从一个问题开始,也适合把图片、资料和文字放在一起分析。

即梦

图片与视频创作

适合视觉创作、图片编辑和短视频尝试;人物、文字和连续动作通常需要多轮修正。

Seedance 2.0

连续视频表达

适合把完整剧本转成视频;要写清主体锁定、动作因果、镜头时长和负面约束。

文字类模型

写作与分析

适合报告、脚本、总结和方案;流畅表达不等于事实正确,发布前要核验。

AI 学习的第一条工作流

先完成一次小任务,再逐步建立自己的方法。

01 认识

判断任务属于哪一类

要写文字、做图片、生成视频,还是需要同时理解图片和文字?

02 描述

用大白话说清目标

告诉 AI 你想完成什么、已有资料、不能出现什么,以及希望交付多少。

03 交付

要求它直接给成品

不要只让 AI 讲方法,明确要求输出可以复制、发布、生成或继续执行的结果。

04 核验

把 AI 当助手,不当权威

核对事实、版权、隐私、专业风险和生成结果,再决定是否使用。