保姆级教程 · 面向纯小白与自媒体人
项目 信息 课程系列 AI 创作入门 · L1 课程编号 L1A-02 难度等级 入门 适用人群 第一次接触生成式 AI,或已在用但分不清各家模型区别的自媒体创作者 预计阅读 60–90 分钟(边读边动手会更有收获) 更新日期 2026 年 8 月 前置课程 L1A-01(提示词基础)
写在前面:模型中提到的模型名称、功能、价格均以 2026 年 8 月市面上的公允情况为准。互联网产品迭代极快,具体价格与功能请以各厂商官方页面为准。本教程只讲"怎么用、怎么选",不追求细节穷举。
先给一张"地图"。这张表把 2026 年 8 月市面上你大概率会听到的模型一次性摆到你面前。下面所有结论,后面章节都会展开解释。
| 模型 | 开发商 | 代表版本(2026-08) | 最大亮点 | 典型不足 | 中文能力 | 免费档 |
|---|---|---|---|---|---|---|
| ChatGPT | OpenAI | GPT-5 / GPT-4o | 综合能力最均衡、生态最全、插件/工具多 | 长文偶尔"话痨"、写作风格偏"AI 味" | 优秀 | 有(限次) |
| Claude | Anthropic | Claude Opus 4 / Sonnet 4 / Haiku 4 | 长文写作、代码、逻辑推理公认最强 | 注册门槛略高(部分地区需要特殊网络) | 优秀 | 有(限次) |
| Gemini | Gemini 2.5 Pro / Flash | 多模态强、Google 生态深度整合、免费额度大方 | 中文内容有时略生硬 | 良好 | 有(较宽松) |
| 模型 | 开发商 | 代表版本(2026-08) | 最大亮点 | 典型不足 | 中文能力 | 免费档 |
|---|---|---|---|---|---|---|
| 豆包 | 字节跳动 | 豆包大模型 1.5 系列 | 中文口语化天然、和抖音生态贴近、免费大方 | 深度长文稍弱 | 极佳 | 免费 |
| 文心一言 | 百度 | 文心大模型 4.5 / 5.0 | 中文知识库强、和百度搜索/文库打通 | 界面稍"重"、老用户改版适应成本 | 极佳 | 免费 |
| 通义千问 | 阿里 | Qwen3 / 千问 2.5 | 开源影响力大、性价比高、多模态齐 | 营销感略弱于豆包 | 极佳 | 免费 |
| Kimi | 月之暗面 | Kimi K2 | 国产"长文之王"、超长上下文、擅长读长文档 | 超长对话偶尔发散 | 极佳 | 免费 |
| DeepSeek | 深度求索 | DeepSeek-V3 / R1 | 性价比极高、推理强、开源免费 | 营销、口语化稍逊 | 优秀 | 免费 |
别背参数,背场景。
- 想写长文、写得好 → Claude、Kimi。
- 想起标题、要网感、顺手 → ChatGPT、豆包。
- 想免费、中文、随手就来 → 豆包、通义、DeepSeek。
- 想推理、总结长文档 → Gemini、DeepSeek、Kimi。
记住这一句,后面所有章节都是在给你展开解释"为什么"。
这一章手把手带你把三个海外模型各注册一个、各跑一段文案。你不必三个都注册——先挑一个最想试的,跑通流程,其余两个作为"了解"即可。但强烈建议你至少注册一个海外模型 + 一个国内模型,这样你才能真正体会到第二节"同一句话不同模型输出差异"那一节的震撼。
官网:chatgpt.com(或 openai.com)
代表版本:GPT-5(旗舰)、GPT-4o(通用)
一句话定位:综合能力最均衡的"六边形战士",大部分人第一个接触的 AI。
chatgpt.com,点击 Sign up(注册)。第一步,新建一个对话。 第二步,把下面这段 Prompt(来自 L1A-01 教你的"指令—上下文—输出格式"三段式)直接复制进输入框:
你是一位资深美食自媒体博主。请帮我把"一个人在家做番茄炒蛋"这件事,写成一个适合抖音的小红书风格标题 + 一条 80 字左右的正文。
要求:
1. 标题要有钩子(让人想点开),控制在 20 字以内。
2. 正文口语化,带一点"人味",不要像说明书。
3. 结尾加 5 个适合的小红书标签。
第三步,回车发送。看看输出。
第四步(关键),不满意就追问。比如:"标题再夸张一点""正文再短一点,改成都第 3 条"。AI 文案不是一次成型,而是反复改出来的——这是 L1A-01 最重要的一课,现在再实践一遍。
官网:claude.ai
代表版本:Claude Opus(最强)、Claude Sonnet(均衡)、Claude Haiku(最快最省)
一句话定位:被自媒体人、文字工作者公认的"写作天花板",长文、小说、深度文章、润色都极强。
这是很多媒体人亲测后的共识,大致有四个原因:
它的不足:注册门槛相对最高(对大陆用户网络环境要求更苛刻);免费额度少,深度使用大概率要订 Pro(约 $20/月,以官方为准)。
claude.ai,点击 Sign up。长文是 Claude 的主场,这段练习最能让你感受到它的强:
你是一位公众号深度内容作者。我要写一篇关于"普通人如何开始做自媒体"的长文,目标是 3000 字。
请先帮我做三件事:
1. 给出 3 个有传播力的大标题选项(每个 20 字内)。
2. 基于我选定的标题方向,输出一份完整的大纲(含引言、5 个小标题小节、结语)。
3. 大纲里每个小节用小字标注"这里想传达的核心观点"。
我暂时选 2 号标题,请直接按 2 号出大纲。
发送后,观察 Claude 给出的大纲结构是否清晰、小标题是否有钩子。然后你可以继续让它"把第 3 小节扩展成 800 字正文"——一次给一个指令,逐步扩张,这是长文生产的正确姿势。
官网:gemini.google.com
代表版本:Gemini 2.5 Pro / Flash
一句话定位:多模态强、免费额度大方、和 Google 全家桶(搜索、Gmail、文档)深度打通。
gemini.google.com。Gemini 擅长处理结构化内容,试试让它把数据转化成文案:
这里是我 3 个月的自媒体涨粉数据:
1 月:粉丝 120,涨粉 20
2 月:粉丝 180,涨粉 60
3 月:粉丝 320,涨粉 140
请把我这组数据写成一段"季度复盘"小红书文案,突出"稳中有进、后劲很足"的氛围,控制在 150 字内,并给出 3 个关键词标签。
Gemini 的中文文案整体不错,但个别时候会比 Claude / 豆包显得"端一点"。如果你觉得"有点说明书味",用 L1A-01 教的润色 Prompt("改成更有人味、更口语化")再改一版即可——任何模型的输出,你都有二次加工权。
| 需求 | 首选 | 第二顺位 |
|---|---|---|
| 综合全能、第一印象 | ChatGPT | Gemini |
| 长文、写作、润色 | Claude | ChatGPT |
| 免费练手、多模态 | Gemini | ChatGPT |
| 逻辑、复盘、结构化 | Claude / Gemini | ChatGPT |
现实中,很多中文自媒体人的主力是 Claude(写长文)+ 豆包 / ChatGPT(起标题、日常)——这正是我们第七节要讲的"多模型搭配"。
海外三巨头有门槛(网络、支付),国内模型最大的好处是:零门槛、免费、中文母语级。这一节把五个国内主流模型各讲 5 分钟,讲清"它是什么、最像谁、适合干嘛"。
国内模型共同点:几乎都用手机号 + 验证码注册,打开 App 或用网页即可,2 分钟搞定,全部有免费档。下面不再重复注册步骤,只讲差异。
入口:豆包 App / doubao.com
代表版本:豆包大模型 1.5 系列
第一段文案实测:把第一节那套"番茄炒蛋"Prompt 丢给它,你会明显感觉它的标题更有网感、更像平台上真实会火的那种——这是它最直观的卖点。
入口:文心一言 App / yiyan.baidu.com
代表版本:文心大模型 4.5 / 5.0 系列
入口:通义 App / tongyi.aliyun.com
代表版本:Qwen3 / 千问 2.5 系列
入口:Kimi App / kimi.moonshot.cn
代表版本:Kimi K2 系列
入口:DeepSeek App / chat.deepseek.com
代表版本:DeepSeek-V3(通用)/ DeepSeek-R1(推理增强)
- 豆包:想火、要网感 → 用它(标题、口播)。
- Kimi:长文、读长文档 → 用它(长文之王)。
- DeepSeek:免费、全能、性价比 → 用它(日常主力)。
- 通义:功能全、多模态、开源 → 用它(稳妥全能)。
- 文心:知识问答、科普、百度生态 → 用它(知识向)。
前面讲的是"每个模型是什么",这一节解决更实际的问题:我到底该用哪个?
选模型不是"哪个最强用哪个",而是**"在什么场景下,哪一个付出最小的成本拿到最满意的结果"**。自媒体人手里同时有两三个模型是常态,不是奢侈。
| 维度 | 问自己 | 说明 |
|---|---|---|
| 速度 | 我急着要吗? | 需要"秒回"的(短视频赶热点),选 Flash / Haiku / 豆包这类轻快模型;写长文慢一点无所谓。 |
| 成本 | 我愿意付费吗? | 学生党 / 新手先用免费档;吃这碗饭的自媒体人,建议订一个主力(如 Claude Pro)当"生产资料"。 |
| 质量 | 我给观众看的内容重要吗? | 发出去的文案 = 你的脸面。给观众看的成品,值得用好模型;自己整理的笔记,用免费的就够。 |
| 中文能力 | 我主要写中文还是英文? | 主要中文内容:国内模型 + Claude 都强;主要英文内容:ChatGPT / Claude / Gemini 更顺。 |
| 你的情况 | 推荐主力 | 推荐备用 | 理由 |
|---|---|---|---|
| 零基础新手、想先免费练手 | 豆包 或 DeepSeek | 通义千问 | 免费、中文、门槛零,先跑通流程 |
| 主要写公众号长文 | Claude | Kimi | 长文与写作双王 |
| 主要做短视频/小红书 | 豆包 | ChatGPT | 网感、口语化、起标题 |
| 主要做知识科普/课程 | 文心 / 通义 | DeepSeek | 中文知识回稳、资料全 |
| 主要做英文内容/跨语言 | ChatGPT / Claude | Gemini | 英文写作与理解全球一流 |
| 预算有限但想要高质量 | DeepSeek | 通义 | 免费/低价里的质量标杆 |
| 想省事、一个模型搞定一切 | ChatGPT | 通义 | 综合最均衡 |
先免费把四个维度都体验一遍,再决定为谁付费。
不要一上来就看排行榜、听别人吹"XX 最强"。同一个 Prompt 在不同模型里的感受差别极大,只有你自己亲手试过才知道哪个"合你的手"。 建议用下面第五节那组"同一句话"测试题,在 3-4 个模型里各跑一遍,看谁给你的感觉最对味,谁就是你未来的主力。
这一节专门回应一个新手最常见的困惑:"不是说 AI 很聪明吗?为什么我在 ChatGPT 里得到的答案,和网上别人贴的不一样?"
答案是:不同的模型,就像不同作家。 同一个题目,有人写得像新闻、有人写得像段子、有人写得像小说。不是谁对谁错,而是各自的"手感"不同。理解这一点,你才不会被任何单一模型"带偏",也才知道什么时候该换一个模型。
我们用同一个简单 Prompt,看看不同风格的模型一般会怎么回答(以下为典型风格的示意,具体以你实际跑的结果为准):
Prompt:“用一句话夸夸我家的猫,要可爱一点。”
ChatGPT 风格(均衡周全)
"它不是在看我,是在确认我还活着——然后决定要不要继续宠我。"
Claude 风格(细腻有文学感)
"它把最柔软的肚皮摊在阳光下,像把整个夏天都借给了我。"
豆包风格(接地气、有网感)
"我家猫:全屋最软的拖鞋,全世界最会'踩奶按摩'的打工喵。"
DeepSeek 风格(直给、逻辑清爽)
"高冷是它的保护色,黏人是它只对我开的特权,这猫,真香。"
你看,没有标准答案。同样的意思,有的偏"文艺"、有的偏"段子"、有的偏"说人话"。你写什么内容,就挑哪种"手感"最贴合的模型。
同样一题"写一个 500 字卖'空气炸锅'的小红书文案",长文章模型能给你结构完整的 500 字;短促网感模型可能给你几行夸张金句让你自己扩。这不是它"不行",而是它的"默认出拳方式"不同。 这时候你要做的,是用 L1A-01 学的格式要求,明确告诉它"我要多长、什么结构",把"出拳方式"拉向你要的方向。
动手做一次"模型横评":
这一步做完,你对"选模型"的认知会从"听别人说"升级成"我自己知道"——这是最值钱的一步。
真正做自媒体的人,几乎不会"一个模型用到底"。因为选题、标题、长文、口语稿、润色,是五种不同的肌肉,不同模型长在不同的肌肉上。用"田忌赛马"的思路分配任务,能让你的产出质量和效率同时上一个台阶。
一套成熟且常见的搭配是这样的:
| 环节 | 推荐模型 | 为什么 |
|---|---|---|
| 选题 / 头脑风暴 | ChatGPT 或 DeepSeek | 发散快、思路宽,能列一堆方向让你挑 |
| 起标题(钩子) | 豆包 或 ChatGPT | 网感、口语化,标题命中率最高 |
| 写长文正文 | Claude 或 Kimi | 长文之王,结构稳、不跑题、有质感 |
| 写短视频口播稿 | 豆包 | 口语化、有节奏,天然贴近口播 |
| 写小红书图文 | 豆包 或 ChatGPT | 短、有网感、带标签,一击即中 |
| 润色 / 改稿 | Claude | 改稿是它的看家本领,"优化并说明为什么改"极专业 |
| 读长文档 / 总结资料 | Kimi 或 Gemini | 长上下文 + 多模态,看 PDF/长网页一绝 |
| 日常问答 / 查资料 | DeepSeek 或 通义 | 免费、快、够用,不浪费好资源 |
上面 8 个环节对新手上手有点多。先用"两个模型"跑通流程,后续再逐步加:
每天流程就三步:
Q1:我是新手,一个模型都没用过,先注册哪个? A:如果你在大陆,先注册豆包或DeepSeek(免费、零门槛、中文好),1 分钟就能开始练手;如果你有条件访问海外,再加一个ChatGPT。别贪多,先把一个用熟。
Q2:ChatGPT 和 Claude 到底哪个强? A:没有一个绝对答案。综合全能上 ChatGPT 更均衡,写作和长文上 Claude 更被公认领先。成年人思路是:看你现在写什么内容,谁合适就用谁,两个都留着当不同用途。
Q3:这些模型全都要钱吗? A:国外三巨头都有免费档(限次),国内五个基本上都免费(或提供充足免费额度)。先全部用免费的,够你练手很久。真正开始靠内容吃饭时,再为"主力模型"(如 Claude Pro)付费当生产资料。
Q4:国内模型和国外模型差很多吗? A:日常文字任务差别已经很小,尤其是在中文、口语化、网感内容上,国内模型(尤其豆包)反而更贴近。差距主要缩小在极长文、极深推理、代码等专业领域,海外模型(Claude、GPT)仍领先。
Q5:同一个 Prompt,为什么换了个模型结果差这么多? A:因为不同模型训练数据、调校风格("人设")不同,就像不同作家写同一个题目。这不代表某个模型"坏了",而是它"手感"不同。用第五节的方法亲手横评一次,你就不会困惑了。
Q6:我用一个模型用习惯了,要不要换? A:不要轻易全换。把主力留住,额外试一两个新的做对比即可。模型迭代很快,但"稳定 + 熟悉"往往比"最新 + 最强"更省心省力。
Q7:模型会不会过几天就"变笨"或收费了? A:会。模型在迭代、免费政策可能调整。所以本教程反复提醒"以官方为准"。应对方法是:别把所有产出流程绑死在单一产品上,多模型搭配(第六节)本身也是抵御政策变化的好习惯。
Q8:我纠结选哪个,怕选错浪费钱。 A:免费档就是为这个设计的。先免费把主流模型都试一遍(第四节给了打分维度、第五节给了横评方法),确定再付费。选"错"的代价,在免费阶段几乎为零。
没有"最好的模型",只有"最适合你这道题"的模型。先把主力选好,把多模型搭配跑起来——工具就位,接下来才是真正的创作。
模型和工具都已经上手了,那么问题来了:"工具我会用了,但文案到底该怎么写才会爆?"
下一课 L1A-03《自媒体文案场景实战》 将带你正式进入创作核心:抖音、小红书、公众号、知乎、微博五大平台的文案结构差异、爆款标题公式、短视频口播稿三件套、以及如何避免 AI 痕迹——把这些一讲透。
到时候你会明白:模型只是笔,真正的功夫在"在哪个平台、用什么结构、把什么钩子放在哪里"。 带着你选好的模型,我们下一课见。