字节跳动豆包大模型系列
以 Seed2.1 Pro/Turbo 与豆包生产力入口为主线,覆盖文本、视觉、GUI Agent、实时语音、图像、视频和向量能力。
- 主线
- Seed2.1 Pro / Turbo
- 上下文
- 按火山方舟中的 Seed 2.0 具体端点核对
- 接入
- 火山方舟 API、豆包企业服务
- 核验
- 2026/09/29
价格观察方舟按模型、模态、上下文区间、缓存与吞吐计费,语音、图像和视频使用独立单位。价格页更新频繁,上线前需按 endpoint ID 和区域重新核算。
从品牌清单升级为企业模型情报层:追踪当前旗舰、上下文、价格、接入方式、Agent 适用性、生命周期与官方证据。家族页负责决策框架,具体端点页负责价格和渠道观察。
同一个品牌下可能同时存在闭源 API、开放权重、专项多模态和不同区域版本。
理解供应商主线、适用任务、生命周期和企业边界。
核对模型 ID、上下文、工具、区域、缓存和实时价格。
用企业样本测成功率、延迟、Token 和人工接管。
固定版本、保留回退、记录选择原因并持续回归。
核验日期逐条列出;超过 7 天的资料标记为待复核,采购前请确认官方最新信息。
以 Seed2.1 Pro/Turbo 与豆包生产力入口为主线,覆盖文本、视觉、GUI Agent、实时语音、图像、视频和向量能力。
价格观察方舟按模型、模态、上下文区间、缓存与吞吐计费,语音、图像和视频使用独立单位。价格页更新频繁,上线前需按 endpoint ID 和区域重新核算。
覆盖 Hy3、Hy4 preview、视觉、图像与企业 Agent 的国产模型家族,并与腾讯云、TokenHub 和腾讯业务生态连接。
价格观察腾讯混元旧文本端点已迁移/下线,最新型号与价格应在 TokenHub 及腾讯云计费页核对;开放权重部署另计 GPU 与运维成本。
Qwen3.7 覆盖云端多模态与 Agent,Qwen3.8-Flash-Next 开放 Qwen4 预览架构权重,保留 API 与私有部署选择。
价格观察中国区 Qwen3.7 Plus 在 256K 内每百万 Token 输入 2 元、输出 8 元,超过 256K 为 6 / 24 元;Qwen3.7 Max 列表价为 12 / 36 元。促销、区域与缓存价需单独核对。
GLM-5.3 与 GLM-5.3-Flash 覆盖长程 Agent、代码、工具调用和原生多模态,并提供 API 与开放权重路径。
价格观察每百万 Token:GLM-5.1 输入 1.4 美元、缓存 0.26 美元、输出 4.4 美元;GLM-5 为 1 / 0.2 / 3.2 美元。人民币区与套餐以对应平台为准。
Claude 5 家族覆盖高端复杂任务、代码、长上下文和工具使用,强调可持续运行的知识工作与企业 Agent。
价格观察每百万 Token:Fable 5 输入 10 美元、输出 50 美元;Opus 5 为 5 / 25 美元;Sonnet 5 为 2 / 10 美元;Haiku 4.5 为 1 / 5 美元。
ERNIE 5.0 与 4.5 Turbo 家族通过千帆提供文本、思考、多模态、搜索、知识库和企业 Agent 集成。
价格观察千帆按具体模型、思考模式、上下文长度和套餐计费;部分端点提供 Token Plan。应在采购区账号中核对实时单价、免费额度和退役日期。
DeepSeek V4 API 主线统一支持思考与非思考模式,并延续代码、推理和开放权重生态的企业评估价值。
价格观察V4 Flash 与 V4 Pro 按缓存命中、缓存未命中输入及输出分别计费;旧的 deepseek-chat、deepseek-reasoner 别名已退出主线,采购应按当前官方价格表和模型 ID 复核。
Gemini 3.x 覆盖复杂推理、代码、Agent、实时交互及原生多模态,并延伸至图像、视频、音乐与计算机操作。
价格观察Gemini 按型号、输入模态、上下文长度、缓存与批处理分别计费;稳定版和预览版价格可能不同,应在上线前按模型详情与 Vertex AI 区域复核。
以 Llama 4 Scout 与 Maverick 为多模态 MoE 主线,拥有成熟的开放权重、微调、推理和多云部署生态。
价格观察Meta 不提供统一官方 Token API 价格;成本取决于云渠道、硬件、量化、批量、利用率和运维。应以目标部署平台的实测吞吐和总拥有成本为准。
以 MiniMax-M3 为最新 Agent 主线,覆盖原生多模态、百万上下文、代码与工具调用,并延伸到语音、视频、图像和音乐。
价格观察M3 在 512K 以内每百万 Token 输入 2.1 元、缓存读取 0.42 元、输出 8.4 元;超过 512K 价格翻倍。页面当前标注长期半价,采购仍应复核活动与区域。
以 Medium 3.5、Small 4、Large 3 与 Ministral 3 为主线,覆盖商业 API、开放权重、多模态、代码、OCR 与语音。
价格观察商业 API、OCR、音频与开放权重部署的计费方式不同;开放模型仍需计算 GPU、推理引擎和运维成本。价格与区域以 Mistral 官方定价页为准。
以 Kimi K3 为百万上下文长程 Agent 主线,覆盖视觉输入、持续思考、代码、动态工具加载与复杂知识工作。
价格观察Kimi K3 每百万 Token 缓存命中 2 元、未命中输入 20 元、输出 100 元。K2.5 与 Moonshot v1 将于 2026-08-31 关闭,旧系统应尽快迁移。
以 GPT-5.6 Sol、Terra、Luna 为当前主线,覆盖复杂推理、代码、工具调用、实时语音、图像生成与开放权重模型。
价格观察GPT-5.6 Sol 每百万 Token 输入 5 美元、缓存输入 0.5 美元、输出 30 美元;Terra 为 2 / 0.2 / 12 美元;Luna 为 0.2 / 0.02 / 1.2 美元。
以 Grok 4.6 为旗舰,覆盖推理、代码、工具调用、实时搜索,以及图像、视频、语音和音频 API。
价格观察Grok 4.6 每百万 Token 输入 2 美元、输出 6 美元;图像从 0.02 美元/张、视频从 0.05 美元/秒、Voice 从 0.05 美元/分钟起。
没有匹配结果,请调整关键词或模型形态。