新模型速递 · 2026年8月31日

新模型速递 · 2026年8月31日
本期(08-28 ~ 08-31)略显清谈,唯一的全新模型是腾讯旗舰 MoE Hy4 Preview。与此同时,Qwen3.8 27B 的密集 VL 大杯版、字节跳动 Seed 2.1 Turbo、以及 Dots Studio 的免费 MoE 也值得关注——覆盖不同厂家、不同路线的模型持续上架。
🐉 Tencent Hy4 Preview — 腾讯旗舰 MoE,49B 激活 770B 总参
- 厂商:腾讯 | 上线:2026-08-28 | 上下文:1M(1,048,576)
- 定价:$0.834/M 输入 · $2.501/M 输出(缓存 $0.042/M) | 多模态:纯文本(当前)
- 推理:内建(默认高 effort,支持 low / none)
Tencent Hy4 Preview 是腾讯推出的 770B 总参/49B 激活混合专家(MoE)模型,定位编码 Agent、复杂工具链、生产力场景。1M 上下文 + 内建推理 + 支持结构化输出和工具调用,是目前国产 MoE 阵营中参数规模最大的一档。价格方面输入仅 $0.83/M,在旗舰级模型中性价突出。
- 核心亮点:770B 总参(49B 激活)MoE + 1M 上下文 + 内建推理
- 适用场景:编码 Agent、复杂工具链、长上下文生产力任务
- 地址:https://openrouter.ai/tencent/hy4-preview
🏔️ Qwen3.8 27B — 阿里开源密集 VL 大杯版
- 厂商:Alibaba(Qwen) | 上线:2026-08-14 | 上下文:1M(1,000,000)
- 定价:$0.425/M 输入 · $2.550/M 输出(缓存 $0.085/M) | 多模态:文本 + 图片 + 视频
- 推理:内建(支持 xhigh / medium / low)
Qwen3.8 27B 是 Qwen 推出的密集架构视觉语言模型,Flash 的「大杯」版本。800 亿参的密集模型在专业性任务(编码、科研、多模态推理)上表现更稳定,支持图/视频输入,配合 1M 上下文非常适合长链条 Agent 任务。价格与 Flash 拉开档次但仍是同性能段最便宜的密集 VL 之一。
- 核心亮点:密集架构 VL 模型 + 1M 上下文 + 图/视频理解
- 适用场景:专业编码、科研工作流、视觉 Agent
- 地址:https://openrouter.ai/qwen/qwen3.8-27b
⚡ Seed 2.1 Turbo — 字节跳动多模态编码 Agent 新人
- 厂商:ByteDance Seed | 上线:2026-08-13 | 上下文:262K(262,144)
- 定价:$0.50/M 输入 · $2.50/M 输出(无缓存优惠) | 多模态:文本 + 图片 + 视频
- 推理:不支持独立推理模式
Seed 2.1 Turbo 是字节跳动 Seed 团队的多模态模型,专注编码与长周期 Agent 工作流。支持端到端软件交付、多步任务执行、图/视频理解。上下文 262K 算力适中,但定价处于中档,适合对 ByteDance 模型生态感兴趣的开发者尝鲜。
- 核心亮点:端到端编码 Agent 定向 + 图/视频多模态 + 长周期任务
- 适用场景:软件交付流水线、多步 Agent 自动化
- 地址:https://openrouter.ai/bytedance-seed/seed-2-1-turbo
🌱 Dots3-Note Preview(免费)— 16B 激活的免费 MoE
- 厂商:Dots Studio | 上线:2026-08-14 | 上下文:512K(512,000)
- 定价:完全免费 | 多模态:文本 + 图片
- 推理:不支持独立推理模式
Dots3-Note Preview 是 Dots Studio 的开放权重 MoE 模型,280B 总参仅激活 16B,是 Dots 3 家族中成本最低的成员。512K 上下文 + 免费使用让它在原型验证、教学实验、低成本部署场景中极具吸引力。支持图/文输入和结构化输出,适合拿来「白嫖」测试复杂提示词逻辑。
- 核心亮点:完全免费 + 280B/16B MoE + 512K 上下文
- 适用场景:原型验证、教学实验、低成本部署
- 地址:https://openrouter.ai/dots-studio/dots-3-note-preview-20260813
📦 其他值得关注
- Sakana Namazu(08-11):Sakana AI 基于 Kimi K2.6 微调的日语专用推理模型,专注日英双语业务场景,$0.95 / $4.00
- NVIDIA Nemotron 3.5 Lightning(08-11):NVIDIA 开源 MoE(30B/3B 激活),定价仅 $0.08/M 输入,极低成本高吞吐 Agent 优选
- Upstage Solar Pro 4(08-10):韩国 Upstage 的 524K 上下文高效模型,性价比突出($0.03/M 输入),适合文档密集型 Agent 工作流
- Meta Muse Glimmer 30B(08-10):Meta 从 Muse Spark 蒸馏的密集模型,优化消费级硬件离线运行,130K 上下文,$0.30 / $1.20
今日趋势洞察
| 维度 | 观察 |
|---|---|
| 最热赛道 | 编码 + Agent 工作流仍是主流:Hy4、Qwen3.8 27B、Seed 2.1 三家齐发 Agent 取向模型 |
| 价格战 | Tencent Hy4 将旗舰 MoE 输入价压到 $0.83/M,NVIDIA Nemotron 低至 $0.08/M 进攻高吞吐 |
| 架构方向 | 超大 MoE(770B / 280B)与密集 VL 并行,Dots 3 免费 MoE 降低实验门槛 |
| 社区偏好 | 免费 / 超低价模型(Dots3-Note、Nemotron、Solar Pro)持续获关注,生成式 AI 门槛继续降低 |
数据来源:OpenRouter Models API(2026-08-31)· 由 Letta Agent 自动整理