第4章 工具详解与使用指南(1/3)· 对话类

摘要:本章系统讲解对话类 AI 工具(大语言模型)的选型与实操。内容覆盖国际三强(Claude、Gemini)与国内六款(豆包、DeepSeek、Kimi、文心一言、通义千问、元宝)的定位、核心功能、版本状态与使用方法;并针对 Claude、Gemini、豆包、DeepSeek 四款主力工具各给出 2 个完整实操示例(含 Prompt 与预期输出)。文末提供「怎么选、怎么用、自测题」三部分小结,帮助零基础读者快速上手并跑通真实场景。


学习目标

学完本章,你应该能够:

  1. 认识对话类 AI 工具的全貌:清楚 Claude、Gemini 两大国际工具,以及豆包、DeepSeek、Kimi、文心一言、通义千问、元宝六款国内工具各自的定位。
  2. 独立完成注册与上手:能自己注册并打开任意一款工具的网页 / App,发出第一段对话。
  3. 写对 Prompt(提示词):掌握「角色 + 任务 + 格式 + 约束」的基本写法,让 AI 给你的回答更像样。
  4. 区分工具长短板:知道写文案、写代码、读长文档、做研究分别该优先用哪一款。
  5. 动手跑通 4 个主力的实操示例:Claude、Gemini、豆包、DeepSeek 各 2 个完整示例,包含输入 Prompt 与预期输出。—

正文讲解

对话类工具(也叫「大语言模型 / LLM」)是当下 AI 的入口级应用:你用自然语言提问,它用自然语言回答。它不搞花哨界面,核心就是「一个对话框」。下面按「国际双雄 → 国内六款」逐一讲解,每款都遵循统一双结构:一、工具介绍 + 二、使用方法

本部分对应大纲「4.1 通用对话与大语言模型(对话类)」。
面向零基础用户,所有操作均可一步步跟着做。内容严格基于 2026 年 8 月 版本信息整理,各工具当前版本如下:

工具名称当前版本(2026-08)
ClaudeOpus 5 / Sonnet 5 / Haiku 4.5 / Fable 5
Gemini3
豆包2.1
DeepSeekV4
KimiK3
文心一言5.1
通义千问Qwen3.8
腾讯元宝混元
一、工具介绍
  • 核心功能:长文本处理、逻辑推理、代码工程、安全性强;支持「扩展思考 / 自适应思考(Extended Thinking)」、计算机使用(Computer Use)、最长 100 万 token 上下文窗口(Opus 5 / Sonnet 5 / Fable 5)。
  • 适用场景:超长文档分析、复杂代码库开发(Claude Code)、法律 / 合同审阅、需要高安全合规的场景。
  • 优势对比:上下文窗口与代码能力第一梯队;幻觉率业界较低;中文略弱于国内模型。
  • 版本状态(2026-08)
    • Claude Opus 5(2026-07-24 发布,旗舰最强);
    • Claude Sonnet 5(默认「工作马」,性价比均衡);
    • Claude Haiku 4.5(最快最便宜);
    • Claude Fable 5(长程 Agent,适合多步骤自主任务);
    • Opus 4 / 4.1 已于 2026 退役,请勿再选用。

二、使用方法

  • 注册获取:浏览器打开 claude.ai 注册(邮箱 / Google);订阅 Pro / Max 解锁 Opus 5 与更高额度;开发者到 console.anthropic.com 获取 API Key。
  • 基础步骤
    1. 新建对话,可点「附加文件」上传 PDF / 代码;
    2. 直接提问或要求分析文档;
    3. 对长任务开启「扩展思考」提升推理质量。
  • 高级功能示例
    • 上传 200 页合同,要求「列出所有责任条款与潜在风险的对照表」。
    • 使用 Claude Code(终端工具)让 AI 对本地代码库做重构与修复。
  • 常见问题 FAQ
    • Q:Claude 中文不如国产模型? A:属实,建议中文创作优先用文心一言、豆包。
    • Q:上下文窗口不够用? A:Opus 5 / Sonnet 5 支持 100 万 token,超长资料无需切片;必要时用「项目(Projects)」归档素材。

4.1.3 Gemini(Google)

一、工具介绍

  • 核心功能:Google DeepMind 多模态模型(Gemini 3 当前主线),原生支持文本 / 图像 / 音频 / 视频 / PDF;实时语音 Gemini Live(可「看」摄像头)、深度研究(Deep Research)、最长 2M 上下文窗口(Gemini 3 Pro / Ultra)。
  • 适用场景:超长资料分析、跨模态理解(如图表 + 文字联合推理)、研究综述、Google 生态办公(Gmail / Docs / Slides)。
  • 优势对比:上下文窗口最长(最高 2M)、与 Google 搜索 / 地图「接地(Grounded)」、免费层可用 2.5 Flash;中文弱于国内模型。
  • 版本状态(2026-08):Gemini 3 为当前主线(3 Pro / Flash,部分预览);2.5 系列稳定至 2026-10-16 退役;「Bard(已停用)」名称已于 2023 年底停用,请勿再引用「Bard(已停用)」。

二、使用方法

  • 注册获取gemini.google.com 或 Android / iOS App,用 Google 账号登录;订阅 Google AI Pro 解锁 2.5 Pro / 3 Pro 与 Workspace 集成;开发者用 aistudio.google.com(Google AI Studio)拿 API Key(Gemini 2.5 Flash 有免费层)。
  • 基础步骤
    1. 对话输入,或直接把文件 / 图片拖入窗口;
    2. 用「@」关联 Drive 文档;
    3. 点「Gemini Live」进入语音实时交互。
  • 高级功能示例
    • 「深度研究」:给一个主题,AI 自动检索多源并生成带引用的研究报告。
    • 用 2M 上下文窗口一次性投喂整本书 + 全部论文,要求「找出矛盾与共识」。
  • 常见问题 FAQ
    • Q:所在地区无法访问? A:请以官方渠道与当地法律法规为准;企业用户可咨询官方支持获取区域部署方案。
    • Q:选 2.5 还是 3? A:生产环境先用稳定的 2.5 Flash / Pro,2026-10 前迁移到 Gemini 3。

4.1.4 国内通用大模型(豆包 / DeepSeek / Kimi / 文心一言 / 通义千问 / 元宝)

本节按「代表工具简述 + 横向对比表」组织。国内工具共同优势:访问便捷、中文优化好、免费额度充足、数据合规驻留。

豆包(字节跳动 · 2.1 系列)

  • 介绍:国民级全能 AI,拥有庞大的用户规模;2026 发布 2.1 系列,新增「办公任务模式」(自主拆解步骤、调用本地 Office / 浏览器执行任务)。中文创意写作、口语化表达最强。
  • 使用要点:App / 网页 / 抖音内直接使用,免费层充足。适合日常问答、短视频脚本、PPT、数据分析。

DeepSeek(深度求索 · V4 系列)

  • 介绍V4 系列(2026-04),全系 100 万 token 上下文窗口;代码、数学、逻辑推理顶尖;开源 + 极低价,支持私有化部署。短板:多模态与生活化交互一般。
  • 使用要点deepseek.com 网页 / APP 免费;开放平台 api.deepseek.com 调用。开发者与理工科研首选。

Kimi(月之暗面 · K3)

  • 介绍K3(2026-07,2.8T 参数) 长文本之王,原生 100 万 token 上下文窗口、超强复杂推理;可一句话生成完整游戏、整合数十份研报。短板:日常响应偏慢、免费层紧。
  • 使用要点kimi.com 网页 / APP;适合长文献阅读、论文、合同、代码库分析。

文心一言(百度 · ERNIE 5.1)

  • 介绍:中文理解与古文诗词领先,联动百度搜索带权威来源;2026 新增「深度阅读」「图表生成」;政企金融私有化成熟、合规强。短板:风格偏保守、更新节奏慢。
  • 使用要点yiyan.baidu.com;适合公文、文史、识图、合规场景。

通义千问(阿里 · Qwen3.8-Max)

  • 介绍:超长文本深度分析突出,原生 100 万 token 上下文窗口;多模态(图 / 语音 / OCR)组合强;开源体系完善、企业市场表现领先。
  • 使用要点tongyi.com / 通义 APP / 阿里云百炼;开发者可用 Qwen 开源权重本地部署。

腾讯元宝(混元)

  • 介绍:深度集成微信生态,支持微信群聊一键总结、公众号检索、京东购物联动;对话流畅、安全合规。
  • 使用要点:元宝 APP / 微信小程序;微信重度用户首选。

国内模型横向对比(2026)

工具核心长板典型场景上下文价格取向
豆包全能均衡、生态联动日常 / 创作 / PPT免费为主
DeepSeek代码数学、性价比编程 / 科研 / 私有化1M极低价
Kimi长文本 / 复杂推理论文 / 合同 / 大代码库1M中等
文心一言中文 / 古文 / 合规公文 / 文史 / 政企订阅
通义千问深度分析 / 多模态企业 / 文档 / 分析1M订阅 + 开源
元宝微信生态群聊总结 / 内容免费为主

国际三强 vs 国内六款 全工具横向对比总表(2026-08)

工具名称当前版本核心长板上下文长度最适合场景
ChatGPTGPT-5.6全能均衡、前端 UI 生成突出约 400K token日常问答、文案创作、数据分析、前端 UI 生成
ClaudeOpus 5 / Sonnet 5 / Haiku 4.5 / Fable 5长文本、代码工程、幻觉率低100 万 token超长文档分析、复杂代码库、合同审阅
Gemini3多模态、深度研究、Google 生态最高 2M token超长资料分析、研究综述、跨模态理解
豆包2.1全能均衡、中文创意写作、生态联动日常问答、短视频脚本、PPT、数据分析
DeepSeekV4代码数学、逻辑推理、性价比100 万 token编程、科研推理、私有化部署
KimiK3长文本、复杂推理100 万 token长文献阅读、论文、合同、大代码库
文心一言5.1中文理解、古文诗词、合规公文、文史、识图、政企合规
通义千问Qwen3.8深度分析、多模态、开源体系100 万 token企业文档分析、多模态、本地部署
腾讯元宝混元微信生态深度集成微信群聊总结、公众号检索、微信重度用户

4.2 操作示例

下面针对 5 款主力工具,每款提供 2 个完整示例。每个示例都包含:场景与前置准备、具体操作步骤、你实际输入的 Prompt、预期输出、常见问题排查。请打开对应工具网页 / App 后跟着做。

一、ChatGPT(2 个示例)

示例 1:写一段文艺风朋友圈文案,推荐一家咖啡馆
  • 场景与前置准备:已注册 ChatGPT 账号、打开 chat.openai.com 网页,使用免费层或 Plus 均可。

  • 具体操作步骤

    1. 点击「New chat」新建对话;
    2. 在底部输入框粘贴下面的 Prompt;
    3. 按回车发送;
    4. 觉得不满意可继续说「再短一点」「换个 emoji」。
  • 你输入的 Prompt

    帮我写一段朋友圈文案,推荐一家咖啡馆,文艺一点。要求:
    - 风格:安静、治愈、带一点慵懒的文艺感
    - 提到「手冲咖啡」「靠窗的位置」「午后阳光」三个元素
    - 不超过 60 字
    - 结尾加一个合适的 emoji
    
  • > 示例输出:

    午后的阳光斜斜落在靠窗的位置,一杯手冲慢慢凉下来。什么都不用赶,就这样坐着,也很好。☕️

  • 常见问题排查

    • 输出太长 / 不够文艺?→ 在 Prompt 里强调「不超过 60 字」「更克制一点」。
    • 免费层答得简单?→ 这是 GPT-5.6 mini 的正常表现,关键任务可升级 Plus 用完整 GPT-5.6。
示例 2:上传 Excel 后用「数据分析」生成图表
  • 场景与前置准备:已注册 ChatGPT 账号;准备一份本地 Excel(例如「2026 上半年各月销售额.xlsx」,含「月份」「销售额」两列)。

  • 具体操作步骤

    1. 新建对话;
    2. 点输入框左侧「+」或回形针图标,上传 Excel 文件;
    3. 输入下面的 Prompt 发送;
    4. ChatGPT 会调用「数据分析」自动生成折线图与洞察,可要求「导出为图片」。
  • 你输入的 Prompt

    请分析这份销售数据:
    1. 用折线图展示各月销售额变化趋势;
    2. 指出增长最快和最慢的月份;
    3. 用一句话总结上半年的整体走势。
    
  • > 示例输出:

    已为你生成折线图(见上方图表)。

    • 增长最快:3 月(环比 +28%),主要受春季促销带动。
    • 增长最慢:5 月(环比 +3%),临近淡季增速放缓。
    • 整体走势:上半年呈「先升后稳」的温和上行,累计同比增长约 19%。
      需要我把图表导出为 PNG 吗?
  • 常见问题排查

    • 上传后无「数据分析」入口?→ 免费层可能受限,确认文件为 .xlsx 且数据规整;Plus 更稳定。
    • 图表报错 / 读错列?→ 检查表头是否含合并单元格或空格,重新整理后重传。

二、Claude(2 个示例)

示例 1:让 Claude 审阅一份合同,列出风险条款
  • 场景与前置准备:已注册 claude.ai 账号;准备一份 PDF 合同(可用任意模板,几十页即可)。

  • 具体操作步骤

    1. 新建对话,点「附加文件」上传 PDF;
    2. 输入下面的 Prompt;
    3. 对长文档可先开启「扩展思考」再发送;
    4. 看完结果可追问「第 3 条风险怎么改」。
  • 你输入的 Prompt

    这是我方(甲方)的一份服务合同,请帮我审阅:
    1. 列出所有「责任划分」相关条款,并标注在第几页;
    2. 指出其中对甲方潜在不利的 3 个风险点;
    3. 用表格呈现「条款位置 | 风险 | 修改建议」。
    
  • > 示例输出:

    已读取文档(共 38 页),定位到 5 处责任条款,重点风险如下:

    条款位置风险修改建议
    第 12 页 第 7.2 条违约责任单方面加重甲方改为双方对等,设上限
    第 19 页 第 9.1 条保密义务期限过长(永久)限为合同终止后 3 年
    第 24 页 第 11 条争议管辖地在乙方所在地改为甲方所在地或仲裁

    需要我起草具体的修改措辞吗?

  • 常见问题排查

    • 中文表达生硬?→ 在 Prompt 末尾加「用自然流畅的中文,避免翻译腔」。
    • 文件太大传不上?→ Opus 5 支持 100 万 token,一般无需切片;仍超限可先转纯文本分段。
示例 2:用 Claude 重构一段 Python 代码
  • 场景与前置准备:已注册 Claude(Opus 5)账号;有一段「能跑但写得乱」的 Python 函数。

  • 具体操作步骤

    1. 新建对话,直接粘贴代码(或上传 .py 文件);
    2. 输入下面的 Prompt;
    3. 把返回的新代码复制到本地运行验证。
  • 你输入的 Prompt

    下面这段 Python 统计函数可读性差、还有重复计算,请帮我重构:
    1. 保持功能不变(输入列表,返回均值和标准差);
    2. 提取重复逻辑、加清晰变量名和注释;
    3. 最后补一个简单单元测试。
    (在此粘贴你的代码)
    
  • > 示例输出:

    重构后的代码:

    import math
    
    def summarize(numbers):
        """返回列表的均值与标准差。"""
        n = len(numbers)
        if n == 0:
            return 0.0, 0.0
        mean = sum(numbers) / n
        variance = sum((x - mean) ** 2 for x in numbers) / n
        return mean, math.sqrt(variance)
    
    def test_summarize():
        assert summarize([2, 4, 4, 4, 5, 5, 7, 9]) == (5.0, 2.0)
        assert summarize([]) == (0.0, 0.0)
    

    已消除重复求和,并加了一个断言测试。

  • 常见问题排查

    • 返回代码报语法错?→ 极少但可能发生,复制时确认未截断;可让 Claude「逐行解释这段代码」。
    • 想接本地代码库?→ 用 Claude Code(终端工具),需 console.anthropic.com 的 API Key。

三、Gemini(2 个示例)

示例 1:用「深度研究」生成一份带引用的调研报告
  • 场景与前置准备:已用 Google 账号登录 gemini.google.com(或 App);可订阅 Google AI Pro 解锁 3 Pro,免费层用 2.5 Flash 也能做基础研究。

  • 具体操作步骤

    1. 新建对话,选择「深度研究(Deep Research)」模式;
    2. 输入下面的 Prompt;
    3. 等待 Gemini 检索多源(几十秒到几分钟);
    4. 查看带引用链接的报告,可要求「导出为 Google 文档」。
  • 你输入的 Prompt

    请做一次深度研究:2026 年「AI 智能体(Agent)」在企业落地的三大主流场景是什么?
    要求:检索近一年的权威来源,给出每个场景的代表性案例,并附引用链接。
    
  • > 示例输出:

    AI Agent 企业落地三大场景(2026)

    1. 客服与工单自动化

    代表:某金融机构用 Agent 处理常见咨询,平均处理时长下降约 35%(来源:行业白皮书 [链接])。

    2. 研发与代码工程

    代表:Claude Code / Cursor 类工具进入工程流水线(来源:Anthropic 博客 [链接])。

    3. 数据分析与决策辅助

    代表:BI + Copilot 自动生成经营看板(来源:Microsoft 文档 [链接])。
    共引用 11 个来源,完整列表见文末。

  • 常见问题排查

    • 报告来源打不开?→ 引用可能失效,点开原文核实(见第六章 6.3)。
    • 免费层研究慢?→ 2.5 Flash 够用;追求质量升 3 Pro。
示例 2:用 2M 上下文一次性对比「整本书 vs 多篇论文」
  • 场景与前置准备:已登录 Gemini 3;准备一份 PDF 电子书 + 2~3 篇 PDF 论文(总页数适中,远未达 2M Token 上限)。

  • 具体操作步骤

    1. 把文件逐个拖入对话窗口;
    2. 输入下面的 Prompt;
    3. Gemini 3 会在超长上下文窗口中联合理解,输出对照结论。
  • 你输入的 Prompt

    我上传了一本书和几篇相关论文。请帮我:
    1. 找出书中观点与论文结论「相互矛盾」的地方,逐条列出;
    2. 再找出「彼此印证」的共识点;
    3. 用「矛盾 | 共识」两栏表格呈现。
    
  • > 示例输出:

    已联合阅读全书(412 页)与 3 篇论文,核心对照如下:

    矛盾共识
    书第 8 章认为「小模型已够用」,论文 A 指出「复杂推理仍需大模型」双方都认同「数据质量决定上限」
    书主张「Agent 今年普及」,论文 B 认为「企业落地慢于预期」均同意「人机协作是主形态」

    需要我针对某一条展开论证吗?

  • 常见问题排查

    • 文件拖不进去?→ 确认是 PDF;超大文件先压缩或拆分。
    • 输出偏泛?→ 在 Prompt 里指定「请引用具体页码」提升精度。

四、豆包(2 个示例)

示例 1:生成一条短视频口播脚本
  • 场景与前置准备:已打开豆包 App 或 doubao.com 网页,登录即可(免费层充足)。

  • 具体操作步骤

    1. 新建对话;
    2. 输入下面的 Prompt;
    3. 可继续说「改成 30 秒版本」「加点梗」。
  • 你输入的 Prompt

    帮我写一条抖音口播脚本,主题:用 3 个习惯告别拖延症。
    要求:口语化、有网感、开头 3 秒抓人,时长约 40 秒,分「画面 + 台词」两栏。
    
  • > 示例输出:

    画面:博主对着镜头叹气,手机砸在桌上
    台词:明知道该干活,手却停不下来刷视频?别急,这 3 个习惯救过我的命。
    画面:字幕弹出「习惯1:两分钟法则」
    台词:第一,两分钟能做完的事,立刻做,别进待办清单。
    画面:切便利贴特写
    台词:第二,睡前写明天三件事,多了不写。第三,手机丢远点,物理隔离最狠。
    画面:比心结尾
    台词:明早试试,评论区交作业!

  • 常见问题排查

    • 风格不够「抖音」?→ 加「多用短句、加 1 个热门梗、结尾引导互动」。
    • 想要更长?→ 说「扩写到 1 分钟,每点加例子」。
示例 2:用「办公任务模式」做一份周报 PPT 大纲
  • 场景与前置准备:已登录豆包 2.1,且版本支持「办公任务模式」(2.1 系列新增);手头有一份本周工作流水文字。

  • 具体操作步骤

    1. 新建对话,开启「办公任务模式」;
    2. 粘贴本周工作记录;
    3. 输入下面的 Prompt,豆包会自主拆解并产出大纲。
  • 你输入的 Prompt

    根据我贴的工作记录,帮我生成一份周报 PPT 大纲:
    1. 结构为「本周进展 / 风险与阻塞 / 下周计划」三页;
    2. 每页用 3~5 个要点,结论先行;
    3. 最后给一页「需要协调的资源」。
    
  • > 示例输出:

    第 1 页 本周进展

    • 完成 A 项目接口联调(进度 80%)
    • 上线 B 功能,日活 +12%
    • 修复 3 个高优 Bug
      第 2 页 风险与阻塞
    • C 依赖第三方延迟,存在排期风险
    • 测试环境不稳定,偶发超时
      第 3 页 下周计划
    • 推进 A 项目上线 / 启动 D 需求评审
      第 4 页 需协调资源
    • 申请 1 名后端支援 C 项目 / 协调测试环境扩容
  • 常见问题排查

    • 找不到「办公任务模式」?→ 确认豆包已更新到 2.1 系列,入口通常在对话框上方工具栏。
    • 大纲太笼统?→ 贴更细的工作记录,并指定「每个要点带数据」。

五、DeepSeek(2 个示例)

示例 1:用 DeepSeek 解一道数学 / 逻辑题(一步步思考)
  • 场景与前置准备:已打开 deepseek.com 或 App,默认免费层即可(DeepSeek V4 推理强)。

  • 具体操作步骤

    1. 新建对话;
    2. 输入下面的 Prompt;
    3. DeepSeek 会展示推理过程,可要求「换种解法」。
  • 你输入的 Prompt

    一个水池,进水管单独开 6 小时注满,出水管单独开 9 小时放空。
    两管同时开,多久能注满空池?请一步步思考并给出最终答案。
    
  • > 示例输出:

    设水池容量为 1。

    • 进水速度:1/6(池/小时)
    • 出水速度:1/9(池/小时)
    • 同时开净速度:1/6 − 1/9 = (3−2)/18 = 1/18(池/小时)
    • 注满时间:1 ÷ (1/18) = 18 小时
      答案:两管同开需 18 小时注满。
  • 常见问题排查

    • 想要更严谨?→ 加「请用方程并验算」。
    • 回答偏简?→ DeepSeek 偏理工风,文案类任务它不擅长,换豆包 2.1 / 文心一言 5.1。
示例 2:用 DeepSeek 写并解释一段代码
  • 场景与前置准备:已登录 DeepSeek;想实现一个小功能(示例:爬取并统计网页词频)。

  • 具体操作步骤

    1. 新建对话;
    2. 输入下面的 Prompt;
    3. 复制代码到本地运行,报错可贴回让它修。
  • 你输入的 Prompt

    用 Python 写一个脚本:读取一个 txt 文件,统计出现频率最高的 10 个中文词(用 jieba 分词),
    输出词和次数。请附:依赖安装命令、运行示例、关键代码注释。
    
  • > 示例输出:

    依赖:pip install jieba

    import jieba
    from collections import Counter
    
    text = open("article.txt", encoding="utf-8").read()
    words = [w for w in jieba.lcut(text) if len(w) > 1]  # 过滤单字
    top10 = Counter(words).most_common(10)
    for w, c in top10:
        print(w, c)
    

    运行:python count.py,将输出词频前十。需要我加上「停用词过滤」吗?

  • 常见问题排查

    • 没装 jieba 报错?→ 先执行 pip install jieba
    • 想私有化部署?→ DeepSeek V4 开源,可本地起模型,适合数据敏感 / 合规要求高的场景(见第六章 6.1)。

小结回顾

一、对话类工具怎么选

  • 写文案 / 短视频 / 日常闲聊:豆包(中文最自然)、文心一言(公文文史)。
  • 写代码 / 数学 / 科研推理:DeepSeek(性价比之王)、Claude(工程最强)、ChatGPT(前端 UI 突出)。
  • 读超长文档 / 合同 / 论文:Claude(100 万 token、幻觉低)、Kimi(长文本王)、Gemini(2M 上下文窗口 + 深度研究)。
  • 多模态 / 研究综述 / Google 生态:Gemini。
  • 微信生态重度用户:元宝。
  • 国际通用、全能均衡:ChatGPT。

二、对话类工具怎么用(通用三步法)

各工具常见问题速查表

工具问题解决方案正文位置
ChatGPT提示「当前区域不可用」检查网络与账号地区设置;企业用户可咨询官方支持获取合规部署方案4.1.1 常见问题 FAQ
ChatGPT回答「一本正经胡说」开启联网搜索并要求「给出引用来源」;关键信息务必人工复核4.1.1 常见问题 FAQ
ChatGPT免费层够用吗日常问答、简单写作够用;重度写作 / 编程 / 长文档建议升级 Plus4.1.1 常见问题 FAQ
ChatGPT输出太长 / 不够文艺在 Prompt 里强调「不超过 60 字」「更克制一点」4.2 示例 1 常见问题排查
ChatGPT免费层答得简单这是 GPT-5.6 mini 的正常表现,关键任务可升级 Plus 用完整 GPT-5.64.2 示例 1 常见问题排查
ChatGPT上传后无「数据分析」入口免费层可能受限,确认文件为 .xlsx 且数据规整;Plus 更稳定4.2 示例 2 常见问题排查
ChatGPT图表报错 / 读错列检查表头是否含合并单元格或空格,重新整理后重传4.2 示例 2 常见问题排查
Claude中文不如国产模型属实;古文 / 诗词 / 本地化文案优先用文心一言、豆包4.1.2 常见问题 FAQ
Claude上下文窗口爆了Opus 5 / Sonnet 5 支持 100 万 token,超长资料无需切片;必要时用「项目(Projects)」归档素材4.1.2 常见问题 FAQ
Claude中文表达生硬在 Prompt 末尾加「用自然流畅的中文,避免翻译腔」4.2 示例 1 常见问题排查
Claude文件太大传不上Opus 5 支持 100 万 token,一般无需切片;仍超限可先转纯文本分段4.2 示例 1 常见问题排查
Claude返回代码报语法错极少但可能发生,复制时确认未截断;可让 Claude「逐行解释这段代码」4.2 示例 2 常见问题排查
Claude想接本地代码库用 Claude Code(终端工具),需 console.anthropic.com 的 API Key4.2 示例 2 常见问题排查
Gemini有些地方无法访问请以官方渠道与当地法律法规为准;企业用户可咨询官方支持获取区域部署方案4.1.3 常见问题 FAQ
Gemini选 2.5 还是 3生产环境先用稳定的 2.5 Flash / Pro,2026-10 前迁移到 Gemini 34.1.3 常见问题 FAQ
Gemini报告来源打不开引用可能失效,点开原文核实4.2 示例 1 常见问题排查
Gemini免费层研究慢2.5 Flash 够用;追求质量升 3 Pro4.2 示例 1 常见问题排查
Gemini文件拖不进去确认是 PDF;超大文件先压缩或拆分4.2 示例 2 常见问题排查
Gemini输出偏泛在 Prompt 里指定「请引用具体页码」提升精度4.2 示例 2 常见问题排查
豆包找不到「办公任务模式」确认豆包已更新到 2.1 系列,入口通常在对话框上方工具栏4.2 示例 2 常见问题排查
豆包大纲太笼统贴更细的工作记录,并指定「每个要点带数据」4.2 示例 2 常见问题排查
豆包风格不够「抖音」加「多用短句、加 1 个热门梗、结尾引导互动」4.2 示例 1 常见问题排查
豆包想要更长说「扩写到 1 分钟,每点加例子」4.2 示例 1 常见问题排查
DeepSeek回答偏简DeepSeek 偏理工风,文案类任务它不擅长,换豆包 2.1 / 文心一言 5.14.2 示例 1 常见问题排查
DeepSeek想要更严谨加「请用方程并验算」4.2 示例 1 常见问题排查
DeepSeek没装 jieba 报错先执行 pip install jieba4.2 示例 2 常见问题排查
DeepSeek想私有化部署DeepSeek V4 开源,可本地起模型,适合数据敏感 / 合规要求高的场景4.2 示例 2 常见问题排查
  1. 写清 Prompt:用「角色 + 任务 + 格式 + 约束」结构,越具体越好。
  2. 多轮追问:第一次不满意就接着改,「更口语 / 更短 / 加例子」。
  3. 交叉验证:关键信息(医疗 / 法律 / 学术 / 数据)务必人工复核,警惕幻觉。

三、自测题(合上文档试试答)

  1. 免费用户想读 200 页合同并找风险,优先选哪款?为什么?
  2. 写一段小红书种草文案,你选豆包还是 DeepSeek?为什么?
  3. Prompt 的「四要素」是哪四个?
  4. Gemini 当前主线版本叫什么?「Bard(已停用)」还能用吗?
  5. 让 AI 分析 Excel 销售趋势,ChatGPT 里该用哪个功能?
  6. DeepSeek V4 的上下文窗口是多少?它的核心短板是什么?
  7. 国内六款模型中,哪款深度集成微信生态?
  8. Claude 2026-08 的旗舰版本是哪一个?

答案提示与解析

1. 免费用户想读 200 页合同并找风险,优先选哪款?为什么?
优先选 Claude。理由:Claude 的 Opus 5 / Sonnet 5 支持 100 万 token 上下文窗口,200 页合同无需切片即可整体投喂;且其幻觉率业界较低,审阅法律条款这类高风险场景更可靠。对照「国际三强 vs 国内六款 全工具横向对比总表」,Claude 的「核心长板」正是「长文本、代码工程、幻觉率低」,「最适合场景」为「超长文档分析、复杂代码库、合同审阅」,与本题需求完全吻合。备选:Kimi(K3,原生 100 万 token,长文本之王)也可胜任,但合同审阅对严谨性要求更高,Claude 幻觉率更低更稳妥。

2. 写一段小红书种草文案,你选豆包还是 DeepSeek?为什么?
豆包。理由:豆包(2.1 系列)的「核心长板」是「全能均衡、中文创意写作、生态联动」,中文创意写作与口语化表达最强,最适合小红书这类强种草、强网感的文案场景;而 DeepSeek(V4)的「核心长板」是「代码数学、逻辑推理、性价比」,偏理工风,文案类任务并非其强项。对照「国内模型横向对比(2026)」表,豆包「典型场景」为「日常 / 创作 / PPT」,DeepSeek 为「编程 / 科研 / 私有化」,二者定位差异明显。若文案偏公文、文史风格,可改用文心一言(5.1)。

5. 让 AI 分析 Excel 销售趋势,ChatGPT 里该用哪个功能?
「数据分析(Data Analysis)」 功能。理由:ChatGPT(GPT-5.6)内置「数据分析」,上传 Excel 后选择该功能即可自动生成折线图与洞察,无需手动写代码。对照「国际三强 vs 国内六款 全工具横向对比总表」,ChatGPT 的「核心长板」含「全能均衡、前端 UI 生成突出」,「最适合场景」含「数据分析」,与本题需求一致。操作要点:上传 .xlsx 文件后输入分析 Prompt(如「用折线图展示各月销售额变化趋势」),免费层可能受限,Plus 更稳定。

6. DeepSeek V4 的上下文窗口是多少?它的核心短板是什么?
DeepSeek V4 的上下文窗口是 100 万 token;核心短板是多模态与生活化交互一般。理由:对照「国际三强 vs 国内六款 全工具横向对比总表」,DeepSeek 的「上下文长度」为「100 万 token」,「核心长板」为「代码数学、逻辑推理、性价比」,短板在正文 4.1.4 节明确标注为「多模态与生活化交互一般」。因此 DeepSeek 适合编程、科研推理、私有化部署等理工场景;若需多模态识图或生活化闲聊,应改用豆包、通义千问等。

Logo

码道开发者社区,聚焦华为云码道 CodeArts 代码智能体,沉淀 Agent、Skill、鸿蒙开发实战内容,供开发者查阅资料、交流技术、分享工程实践

更多推荐