AI
开始学习

M1-L3 · 2026 年的 AI 工具地图:一次选定,不再纠结


适合谁读这节课

适合:被铺天盖地的"AI 工具榜"搞乱了,不知道该用哪个,或者不确定自己用的是不是对的工具的人。

不适合:已经固定了工具组合、只想学怎么更好地用的人——直接跳 M2。

读完这节课你能做到什么:根据你的具体使用场景,选定一个主力工具,搭配 1 个辅助工具,开始用,不再被新工具广告分心。


先说一个让很多人意外的事实

大多数人以为:AI 工具越新越好,换最新的就是换最强的。

实际情况是:不同 AI 工具有不同的"个性"——它们的强项、弱项、特别设计的使用场景都不同。就像不同的人类专家:律师和设计师都很专业,但你不会找律师设计 Logo。

所以工具选择的核心不是"谁更强",而是"谁更适合你现在要做的事"。


主要工具的"个性"拆解

Claude(Anthropic 出品)

擅长

  • 超长文档处理——一次读完几十页的报告、合同、书稿,帮你提炼或改写
  • 保持文风稳定——连续多轮对话中,能保持风格一致性,不会"忘记"你的语气要求
  • 复杂结构化任务——能理解"先做A,再根据A的结果做B,最后按这个格式输出"这种多步指令
  • Artifacts 功能——生成的文档、代码可以在独立窗口实时预览和编辑,不需要反复粘贴

弱点

  • 国内需要梯子才能访问
  • 工具生态不如 ChatGPT 丰富(图片生成、语音等)

适合你如果:你经常处理长文档,做大量改写,或者需要 AI 长期记住你的风格。


ChatGPT / GPT-4o(OpenAI 出品)

擅长

  • 多模态——文字、图片、语音三合一,GPT-4o 可以直接分析图片、用语音对话
  • 工具生态——DALL-E 画图、代码执行、文件分析都集成在一个对话里
  • 通用性最强——大多数任务都能处理,是公认的"全能选手"

弱点

  • 国内需要梯子
  • 免费版功能有限,主要靠付费($20/月 Plus)

适合你如果:你需要一个"什么都能做"的通用工具,或者经常需要图片生成。


DeepSeek(深度求索出品,国产)

擅长

  • 数学和代码——推理能力特别强,超越很多闭源模型
  • 价格极低——API 价格是 GPT-4 的 1/10 甚至更低
  • 开源——核心模型开放,可以本地部署(隐私敏感场景有优势)
  • 中英文都强

弱点

  • 多模态能力(图片、语音)相对弱
  • 某些话题有限制(国产模型的共同特点)

适合你如果:你是开发者或者需要大量 API 调用,或者你需要强推理能力。

特别值得关注的一点:DeepSeek R1 模型(推理版)发布时,在多项基准测试上比肩 OpenAI o1,但是开源的、价格是它的几十分之一。这打破了"最强模型必然来自美国大厂"的假设,也是 2025 年 AI 领域最重要的事件之一。


Kimi(月之暗面出品,国产)

擅长

  • 超长上下文处理——200 万 token 上下文窗口,目前国内最强之一,可以一次读完一整本书
  • 中文理解质量高
  • 文档上传——PDF、Word、PPT 上传直接提问
  • 联网搜索功能

弱点

  • 代码能力不及 DeepSeek
  • 移动端体验不如豆包

适合你如果:你经常需要读长文档、分析报告,或者上传文件提问。


豆包(字节跳动出品,国产)

擅长

  • 手机端体验最好——APP 功能完整,适合移动端使用
  • 语音对话
  • 中文轻内容创作(小红书风格、朋友圈文案)
  • 免费

弱点

  • 深度任务(长文分析、复杂改写)不如 Claude
  • 推理能力不如 DeepSeek

适合你如果:你主要在手机上工作,或者主要做短内容、轻量任务。


通义千问(阿里出品,国产)

擅长

  • 多模态较强——支持图片、视频理解
  • 免费额度大
  • 与阿里系生态(钉钉、淘宝)整合好

弱点

  • 纯文字写作质量不及 Claude 和 ChatGPT

适合你如果:你在阿里生态工作,或者需要大量免费额度测试。


文心一言(百度出品,国产)

擅长

  • 中文内容,特别是百度生态内的场景
  • 联网搜索质量在国内工具里不错
  • 不需要梯子

弱点

  • 相比 DeepSeek、Kimi,整体能力偏弱

适合你如果:你习惯用百度生态,或者团队在用百度的企业服务。


选工具的决策树

不需要看完上面所有内容。 直接走这棵决策树:

第一问:你主要在哪个设备上工作?

手机为主 → 豆包(最好的手机端体验)

电脑为主 → 第二问:你能用梯子吗?

    不能 → 第三问:你的主要任务是什么?
        长文档阅读/分析 → Kimi
        写代码/数学推理 → DeepSeek
        通用写作/改写   → Kimi 或 通义

    能   → 第四问:你最常做什么任务?
        长文写作/改写/文风保持 → Claude
        通用任务/需要画图      → ChatGPT
        代码/API大量调用       → DeepSeek(API)

实用的双轨配置

对大多数内容从业者,推荐这个最小组合:

国内环境(无梯子)

  • 主力:Kimi(长文档 + 通用写作)
  • 辅助:秘塔 AI 搜索(信息核查 + 联网查最新资讯)

国际环境(有梯子)

  • 主力:Claude(写作 / 改写 / 长内容)
  • 辅助:Perplexity 或 ChatGPT(信息核查 + 多模态任务)

一个经常被忽视的工具类型:搜索增强型

上面讲的都是"对话型 AI"(你提问,它回答)。还有一类工具专门做"先搜索,再整合回答"——对内容从业者来说,这类工具是查资料核查信息的神器,而不是写作工具:

工具特点
秘塔 AI(metaso.cn)中文最强,带信息来源引用,适合核查中文信息
Perplexity AI英文最强,来源清晰,适合核查英文内容
豆包联网版使用方便,但来源引用没那么清晰

使用场景:当你拿到 AI 给的某个数据或引用,用搜索增强工具去核查它是否真实。


什么时候考虑换工具

不要随便换工具的情况

  • "听说那个工具最近出了新功能"
  • "我觉得那个好像更强"
  • 同行在讨论某个新工具

该换工具的情况

  • 你现在的工具卡住了你(做不了你需要做的事)
  • 价格变了,某个工具突然不适合你的预算
  • 你的核心任务类型变了(从写短文案到分析长报告)

够用原则:把一个工具用深,比同时开 5 个工具浅用效率高 10 倍。


引导练习

任务

  1. 打开你现在最常用的 AI 工具
  2. 给它这个任务(用你自己的内容领域替换括号):

    "帮我给一篇关于[你的内容领域]的文章想 5 个标题,目标读者是[你的读者描述],风格是[你的常用风格]"

  3. 观察结果:
    • 它理解你的读者描述了吗?
    • 给的标题语气符合你的风格吗?
    • 有没有一个标题你会真的考虑用?

目的:通过真实使用感受工具的能力,而不是通过看评测决定。


独立挑战

关掉讲义,独立完成。

场景:你有两个朋友问你工具推荐:

朋友 A:做微信公众号,主要写 2000 字以上的深度文章,偶尔需要分析行业报告。没有梯子,不想折腾。

朋友 B:做小红书,主要是短内容,经常在手机上写,需要经常查最新热点。有梯子。

用不超过 100 字,给每个人一个具体推荐(工具名 + 主要用途 + 一个注意事项)。


量规

通过条件:

  • 你推荐了具体的工具名(不是"看你的需求")
  • 推荐理由和两位朋友的具体情况(环境 / 任务类型)有明确关联
  • 你提到了至少一个"这个工具的局限"(不是只说优点)
  • 两个推荐加起来不超过 200 字

模块 1 小结

你已经完成了模块 1 的三节课。在继续之前,不看讲义回答这三个问题:

  1. 为什么"预测下一个词"的机制,导致 AI 会自信地说错误的话?
  2. 当你改了 50 次提示词结果还是不对,这最可能是什么问题?
  3. 如果你在国内没有梯子,主要做长文写作和文档分析,你会用哪个工具?

三个都能流畅回答,进入模块 2。


进入模块 2

M2 · 工作台与第一次实战

工具选好了,接下来真正把 AI 接到你的工作里。你会学会一个经过验证的提示词框架,用它处理你真实的工作任务——不是练习题,而是你正在做的事。