普通用户看到 GPT、Claude、Gemini、DeepSeek、Qwen、Kimi,常把公司名、产品名和模型名混在一起。比如 ChatGPT 是产品,GPT 是模型家族;Claude 既是产品品牌,也是一组模型;同一家厂商还会同时提供旗舰、快速、低成本和专用模型。
本篇不做转瞬即逝的排行榜,而以 2026 年 7 月 26 日的官方页面为快照,给出一张能持续使用的选择地图。具体型号会变,判断维度不会那么快过时。
没有“永远最强”的模型,只有在当前任务、成本、地区、隐私与工具环境下更合适的选择。
01 / FAMILIES先认家族,再认具体型号。
海外常见家族包括 OpenAI 的 GPT 与 Codex、Anthropic 的 Claude、Google 的 Gemini、Meta 的 Llama;中国团队常见的有 DeepSeek、阿里 Qwen、月之暗面 Kimi 等。每个家族内部通常有不同速度、成本、推理深度和多模态能力。
OpenAI / GPT
覆盖通用对话、推理、代码、图像、音频与实时交互;官方模型页应作为型号现状的第一入口。
Anthropic / Claude
通用与代码 Agent 场景常见,产品、API 和 Claude Code 是不同入口,地区与账户政策需单独核对。
Google / Gemini
强调多模态、长上下文和 Google 生态;Stable、Preview、Latest 等后缀代表不同稳定性。
DeepSeek / Qwen / Kimi
中文体验、国内可用入口和开放权重生态较活跃,也各自提供网页产品、API 或本地模型。
02 / SNAPSHOT型号只是快照,不要把文章当实时菜单。
截至本页核验日,OpenAI 官方模型页突出 GPT-5 系列及代码、音视频和开放权重型号;Google 官方页区分 Gemini 3 系列的稳定与预览模型;DeepSeek 官方更新页列出 V4-Pro 与 V4-Flash;Qwen 与 Kimi 则持续在官方 GitHub 和模型平台发布开放权重型号。
这些名字以后必然变化。真正使用时,先打开厂商官方模型页,查看是否仍可用、是否为预览、上下文和输出限制、价格、支持的输入类型与工具能力。
文章负责教你怎样看菜单,官方页面才是今天真正供应什么。
03 / CHOICE普通用户用五个问题选择。
如果只是日常改写和总结,不必默认选择最贵的旗舰模型;复杂研究、代码仓库、多模态文件或长任务才更依赖高能力档。模型是否能联网、读附件、调用工具,往往比单项榜分更影响真实体验。
- 任务:写作、检索、代码、图片、音频,还是需要实际操作?
- 入口:网页产品已经够用,还是需要桌面、CLI、API 或本地部署?
- 限制:所在地区、支付方式、账户和企业政策是否正式支持?
- 隐私:材料能否上传云端,还是必须留在本机或自有服务器?
- 成本:按月订阅、按 token 计费,还是用本地硬件承担成本?
04 / COMPARE比较模型时,固定任务与验收标准。
不要拿不同问题的主观印象比较模型。准备三到五个来自自己工作的固定任务,给每个模型相同材料与要求,记录正确性、来源、耗时、修改次数和最终是否可用。连续更新同一套小测试,比看一张综合排行榜更接近你的真实选择。
学习来源与阅读边界
- OpenAI Models:当前 GPT、Codex、开放权重与多模态型号。
- Anthropic Models Overview:Claude 模型与能力说明。
- Gemini API Models:Stable、Preview 与最新 Gemini 型号。
- DeepSeek Change Log:API 型号与弃用时间。
- QwenLM GitHub:Qwen 官方开放模型仓库。
- Kimi K2.5:月之暗面官方开放模型仓库。
- 《深入理解 AI Agent》开源仓库:十章工程主线与术语来源。
- 本前置系列由本站为非技术读者补写,使用生活化例子降低入口门槛,不替代原书。
- 不用访问 GitHub 也能在本站读完整内容并完成预编排互动;原始链接仅供想继续深挖的读者使用。
下一篇:开源、闭源与开放权重,不是一回事。
继续保持“先建立直觉,再补术语与工程细节”的顺序。
打开交互实验室 ↗继续零基础路线 →

读者评论
把这篇文章留给你的想法写下来。
还没有评论。你可以留下第一条。