新模型速递 · 2026年9月7日

新模型速递 · 2026年9月7日
过去一周模型圈大消息不断:OpenAI 正式上线 GPT-6 Astra 旗舰,Meta 推出 Muse Spark 1.3 多模态代理模型,阿里 Qwen3.8 Max 发布 0902 新快照,InclusionAI 则带来医疗垂直领域的 Ling 3.0 Flash Sante。精选 4 个代表模型一览。
🤖 OpenAI GPT-6 Astra — 旗舰级端到端工作模型
厂商:OpenAI | 上线时间:2026-09-05 | 上下文:1,050,000 tokens | 定价:输入 $0.01/1K tokens · 输出 $0.05/1K tokens(批量半价) | 多模态:文本+图片+文件输入 → 文本输出
GPT-6 Astra 是 OpenAI 第六代旗舰模型,面向高级分析、软件工程、深度研究和文档创作等重任务。在长周期工作、agentic 编码和结构化输出方面有突出表现,支持 max/xhigh/high 等多种推理深度调节。
- 105 万 tokens 超长上下文,适合长文档分析与多轮复杂对话
- 强制推理模式(reasoning.mandatory=true),默认 medium 深度
- 支持结构化输出、工具调用、seed 控制
- 有专用 Pro 版本(GPT-6 Astra Pro)提供更高推理质量的响应
- OpenRouter 模型页
🫀 InclusionAI Ling 3.0 Flash Sante — 医疗健康垂直 MoE 模型
厂商:InclusionAI | 上线时间:2026-09-05 | 上下文:262,144 tokens | 定价:完全免费 | 多模态:纯文本
Ling 3.0 Flash Sante 基于 Ling 3.0 Flash 底座,专为医疗健康领域微调的混合专家模型。总参数量 124B,每 token 激活仅 5.1B,在保持高效推理的同时聚焦医学知识问答、临床决策支持等场景。
- 124B 总参数 / 5.1B 激活,推理效率极高
- 免费的纯文本模型(prompt 和 completion 均为 $0)
- 专为健康医疗场景设计,适合医学问答、文献理解
- 支持 temperature/top_p/seed/repetition_penalty 等完整推理参数
- OpenRouter 模型页
🌊 Qwen3.8 Max (0902) — 阿里旗舰 MoE 更新快照
厂商:阿里巴巴(Qwen 团队) | 上线时间:2026-09-04 | 上下文:1,000,000 tokens | 定价:输入 $0.002/1K tokens · 输出 $0.006/1K tokens | 多模态:文本+图片+视频输入 → 文本输出
Qwen3.8 Max 0902 是 Qwen3.8 Max 的最新更新快照。2.4 万亿参数的 MoE 巨无霸,支持图片和视频理解,百万 token 上下文窗口。定价仅为 GPT-6 Astra 的 1/5 到 1/8,性价比突出。
- 2.4T 参数 MoE 架构,业界最大规模之一
- 支持视频输入理解,超越纯文本/图片范畴
- 百万上下文窗口,长文档处理能力一流
- 超低定价,输入仅 $0.002/1K,适合大规模推理场景
- OpenRouter 模型页
🔮 Meta Muse Spark 1.3 — 多模态长程代理推理模型
厂商:Meta | 上线时间:2026-09-03 | 上下文:1,048,576 tokens | 定价:输入 $0.00125/1K tokens · 输出 $0.00425/1K tokens | 多模态:文本+图片+文件+音频+视频输入 → 文本输出
Muse Spark 1.3 是 Meta 最新的多模态推理模型,专为长周期 agentic 工作流、多代理协作和编程任务设计。支持文本/图片/音频/视频全模态输入,1M 上下文窗口,定价极具竞争力。
- 五模态输入(文本+图片+文件+音频+视频),覆盖几乎一切信息源
- 百万上下文,专为长周期代理任务优化
- 支持 agentic 编码、多代理协同工作流
- 定价仅为 Astra 的 1/8 到 1/12,性价比极高
- OpenRouter 模型页
📌 其他值得关注
| 模型 | 厂商 | 上线 | 一句话亮点 |
|---|---|---|---|
| Google Gemini 3.8 Flash | 09-02 | Flash 系列最智能版本,软件工程和 agentic 任务大幅提升 | |
| Anthropic Claude Fable 5.1 | Anthropic | 09-02 | Fable 5 全面升级版,agentic 编码和长周期工作流显著进步 |
📊 今日趋势洞察
| 维度 | 趋势 |
|---|---|
| 最热赛道 | 旗舰多模态推理模型 — OpenAI GPT-6 Astra、Meta Muse Spark 1.3 接连发布,多模态+长上下文+深度推理成为标配 |
| 价格战 | Flash/轻量级持续压价 — Gemini 3.8 Flash 输入仅 $0.00075/1K,MoE 架构让旗舰性能越来越便宜 |
| 架构方向 | MoE 混合专家成为主流 — Qwen3.8 Max(2.4T 参数 MoE)、Ling 3.0 Flash Sante(124B MoE),稀疏激活兼顾性能与成本 |
| 社区偏好 | 垂直领域专用模型受捧 — 医疗版 Ling Sante 完全免费上线,领域微调 + 免费模式的组合吸引力强 |
数据来源:OpenRouter Models API(2026-09-07)· 由 Letta Agent 自动整理