M1-L3 · 2026 年的 AI 工具地图:一次选定,不再纠结
适合谁读这节课
适合:被铺天盖地的"AI 工具榜"搞乱了,不知道该用哪个,或者不确定自己用的是不是对的工具的人。
不适合:已经固定了工具组合、只想学怎么更好地用的人——直接跳 M2。
读完这节课你能做到什么:根据你的具体使用场景,选定一个主力工具,搭配 1 个辅助工具,开始用,不再被新工具广告分心。
先说一个让很多人意外的事实
大多数人以为:AI 工具越新越好,换最新的就是换最强的。
实际情况是:不同 AI 工具有不同的"个性"——它们的强项、弱项、特别设计的使用场景都不同。就像不同的人类专家:律师和设计师都很专业,但你不会找律师设计 Logo。
所以工具选择的核心不是"谁更强",而是"谁更适合你现在要做的事"。
主要工具的"个性"拆解
Claude(Anthropic 出品)
擅长:
- 超长文档处理——一次读完几十页的报告、合同、书稿,帮你提炼或改写
- 保持文风稳定——连续多轮对话中,能保持风格一致性,不会"忘记"你的语气要求
- 复杂结构化任务——能理解"先做A,再根据A的结果做B,最后按这个格式输出"这种多步指令
- Artifacts 功能——生成的文档、代码可以在独立窗口实时预览和编辑,不需要反复粘贴
弱点:
- 国内需要梯子才能访问
- 工具生态不如 ChatGPT 丰富(图片生成、语音等)
适合你如果:你经常处理长文档,做大量改写,或者需要 AI 长期记住你的风格。
ChatGPT / GPT-4o(OpenAI 出品)
擅长:
- 多模态——文字、图片、语音三合一,GPT-4o 可以直接分析图片、用语音对话
- 工具生态——DALL-E 画图、代码执行、文件分析都集成在一个对话里
- 通用性最强——大多数任务都能处理,是公认的"全能选手"
弱点:
- 国内需要梯子
- 免费版功能有限,主要靠付费($20/月 Plus)
适合你如果:你需要一个"什么都能做"的通用工具,或者经常需要图片生成。
DeepSeek(深度求索出品,国产)
擅长:
- 数学和代码——推理能力特别强,超越很多闭源模型
- 价格极低——API 价格是 GPT-4 的 1/10 甚至更低
- 开源——核心模型开放,可以本地部署(隐私敏感场景有优势)
- 中英文都强
弱点:
- 多模态能力(图片、语音)相对弱
- 某些话题有限制(国产模型的共同特点)
适合你如果:你是开发者或者需要大量 API 调用,或者你需要强推理能力。
特别值得关注的一点:DeepSeek R1 模型(推理版)发布时,在多项基准测试上比肩 OpenAI o1,但是开源的、价格是它的几十分之一。这打破了"最强模型必然来自美国大厂"的假设,也是 2025 年 AI 领域最重要的事件之一。
Kimi(月之暗面出品,国产)
擅长:
- 超长上下文处理——200 万 token 上下文窗口,目前国内最强之一,可以一次读完一整本书
- 中文理解质量高
- 文档上传——PDF、Word、PPT 上传直接提问
- 联网搜索功能
弱点:
- 代码能力不及 DeepSeek
- 移动端体验不如豆包
适合你如果:你经常需要读长文档、分析报告,或者上传文件提问。
豆包(字节跳动出品,国产)
擅长:
- 手机端体验最好——APP 功能完整,适合移动端使用
- 语音对话
- 中文轻内容创作(小红书风格、朋友圈文案)
- 免费
弱点:
- 深度任务(长文分析、复杂改写)不如 Claude
- 推理能力不如 DeepSeek
适合你如果:你主要在手机上工作,或者主要做短内容、轻量任务。
通义千问(阿里出品,国产)
擅长:
- 多模态较强——支持图片、视频理解
- 免费额度大
- 与阿里系生态(钉钉、淘宝)整合好
弱点:
- 纯文字写作质量不及 Claude 和 ChatGPT
适合你如果:你在阿里生态工作,或者需要大量免费额度测试。
文心一言(百度出品,国产)
擅长:
- 中文内容,特别是百度生态内的场景
- 联网搜索质量在国内工具里不错
- 不需要梯子
弱点:
- 相比 DeepSeek、Kimi,整体能力偏弱
适合你如果:你习惯用百度生态,或者团队在用百度的企业服务。
选工具的决策树
不需要看完上面所有内容。 直接走这棵决策树:
第一问:你主要在哪个设备上工作?
手机为主 → 豆包(最好的手机端体验)
电脑为主 → 第二问:你能用梯子吗?
不能 → 第三问:你的主要任务是什么?
长文档阅读/分析 → Kimi
写代码/数学推理 → DeepSeek
通用写作/改写 → Kimi 或 通义
能 → 第四问:你最常做什么任务?
长文写作/改写/文风保持 → Claude
通用任务/需要画图 → ChatGPT
代码/API大量调用 → DeepSeek(API)
实用的双轨配置
对大多数内容从业者,推荐这个最小组合:
国内环境(无梯子):
- 主力:Kimi(长文档 + 通用写作)
- 辅助:秘塔 AI 搜索(信息核查 + 联网查最新资讯)
国际环境(有梯子):
- 主力:Claude(写作 / 改写 / 长内容)
- 辅助:Perplexity 或 ChatGPT(信息核查 + 多模态任务)
一个经常被忽视的工具类型:搜索增强型
上面讲的都是"对话型 AI"(你提问,它回答)。还有一类工具专门做"先搜索,再整合回答"——对内容从业者来说,这类工具是查资料核查信息的神器,而不是写作工具:
| 工具 | 特点 |
|---|---|
| 秘塔 AI(metaso.cn) | 中文最强,带信息来源引用,适合核查中文信息 |
| Perplexity AI | 英文最强,来源清晰,适合核查英文内容 |
| 豆包联网版 | 使用方便,但来源引用没那么清晰 |
使用场景:当你拿到 AI 给的某个数据或引用,用搜索增强工具去核查它是否真实。
什么时候考虑换工具
不要随便换工具的情况:
- "听说那个工具最近出了新功能"
- "我觉得那个好像更强"
- 同行在讨论某个新工具
该换工具的情况:
- 你现在的工具卡住了你(做不了你需要做的事)
- 价格变了,某个工具突然不适合你的预算
- 你的核心任务类型变了(从写短文案到分析长报告)
够用原则:把一个工具用深,比同时开 5 个工具浅用效率高 10 倍。
引导练习
任务:
- 打开你现在最常用的 AI 工具
- 给它这个任务(用你自己的内容领域替换括号):
"帮我给一篇关于[你的内容领域]的文章想 5 个标题,目标读者是[你的读者描述],风格是[你的常用风格]"
- 观察结果:
- 它理解你的读者描述了吗?
- 给的标题语气符合你的风格吗?
- 有没有一个标题你会真的考虑用?
目的:通过真实使用感受工具的能力,而不是通过看评测决定。
独立挑战
关掉讲义,独立完成。
场景:你有两个朋友问你工具推荐:
朋友 A:做微信公众号,主要写 2000 字以上的深度文章,偶尔需要分析行业报告。没有梯子,不想折腾。
朋友 B:做小红书,主要是短内容,经常在手机上写,需要经常查最新热点。有梯子。
用不超过 100 字,给每个人一个具体推荐(工具名 + 主要用途 + 一个注意事项)。
量规
通过条件:
- 你推荐了具体的工具名(不是"看你的需求")
- 推荐理由和两位朋友的具体情况(环境 / 任务类型)有明确关联
- 你提到了至少一个"这个工具的局限"(不是只说优点)
- 两个推荐加起来不超过 200 字
模块 1 小结
你已经完成了模块 1 的三节课。在继续之前,不看讲义回答这三个问题:
- 为什么"预测下一个词"的机制,导致 AI 会自信地说错误的话?
- 当你改了 50 次提示词结果还是不对,这最可能是什么问题?
- 如果你在国内没有梯子,主要做长文写作和文档分析,你会用哪个工具?
三个都能流畅回答,进入模块 2。
进入模块 2
M2 · 工作台与第一次实战
工具选好了,接下来真正把 AI 接到你的工作里。你会学会一个经过验证的提示词框架,用它处理你真实的工作任务——不是练习题,而是你正在做的事。