新模型速递 · 2026年8月31日

更新于 2026-08-31 10:05# Agent# 资讯# AI

新模型速递 · 2026年8月31日

本期(08-28 ~ 08-31)略显清谈,唯一的全新模型是腾讯旗舰 MoE Hy4 Preview。与此同时,Qwen3.8 27B 的密集 VL 大杯版、字节跳动 Seed 2.1 Turbo、以及 Dots Studio 的免费 MoE 也值得关注——覆盖不同厂家、不同路线的模型持续上架。

🐉 Tencent Hy4 Preview — 腾讯旗舰 MoE,49B 激活 770B 总参

  • 厂商:腾讯 | 上线:2026-08-28 | 上下文:1M(1,048,576)
  • 定价:$0.834/M 输入 · $2.501/M 输出(缓存 $0.042/M) | 多模态:纯文本(当前)
  • 推理:内建(默认高 effort,支持 low / none)

Tencent Hy4 Preview 是腾讯推出的 770B 总参/49B 激活混合专家(MoE)模型,定位编码 Agent、复杂工具链、生产力场景。1M 上下文 + 内建推理 + 支持结构化输出和工具调用,是目前国产 MoE 阵营中参数规模最大的一档。价格方面输入仅 $0.83/M,在旗舰级模型中性价突出。

🏔️ Qwen3.8 27B — 阿里开源密集 VL 大杯版

  • 厂商:Alibaba(Qwen) | 上线:2026-08-14 | 上下文:1M(1,000,000)
  • 定价:$0.425/M 输入 · $2.550/M 输出(缓存 $0.085/M) | 多模态:文本 + 图片 + 视频
  • 推理:内建(支持 xhigh / medium / low)

Qwen3.8 27B 是 Qwen 推出的密集架构视觉语言模型,Flash 的「大杯」版本。800 亿参的密集模型在专业性任务(编码、科研、多模态推理)上表现更稳定,支持图/视频输入,配合 1M 上下文非常适合长链条 Agent 任务。价格与 Flash 拉开档次但仍是同性能段最便宜的密集 VL 之一。

⚡ Seed 2.1 Turbo — 字节跳动多模态编码 Agent 新人

  • 厂商:ByteDance Seed | 上线:2026-08-13 | 上下文:262K(262,144)
  • 定价:$0.50/M 输入 · $2.50/M 输出(无缓存优惠) | 多模态:文本 + 图片 + 视频
  • 推理:不支持独立推理模式

Seed 2.1 Turbo 是字节跳动 Seed 团队的多模态模型,专注编码与长周期 Agent 工作流。支持端到端软件交付、多步任务执行、图/视频理解。上下文 262K 算力适中,但定价处于中档,适合对 ByteDance 模型生态感兴趣的开发者尝鲜。

🌱 Dots3-Note Preview(免费)— 16B 激活的免费 MoE

  • 厂商:Dots Studio | 上线:2026-08-14 | 上下文:512K(512,000)
  • 定价:完全免费 | 多模态:文本 + 图片
  • 推理:不支持独立推理模式

Dots3-Note Preview 是 Dots Studio 的开放权重 MoE 模型,280B 总参仅激活 16B,是 Dots 3 家族中成本最低的成员。512K 上下文 + 免费使用让它在原型验证、教学实验、低成本部署场景中极具吸引力。支持图/文输入和结构化输出,适合拿来「白嫖」测试复杂提示词逻辑。

📦 其他值得关注

  • Sakana Namazu(08-11):Sakana AI 基于 Kimi K2.6 微调的日语专用推理模型,专注日英双语业务场景,$0.95 / $4.00
  • NVIDIA Nemotron 3.5 Lightning(08-11):NVIDIA 开源 MoE(30B/3B 激活),定价仅 $0.08/M 输入,极低成本高吞吐 Agent 优选
  • Upstage Solar Pro 4(08-10):韩国 Upstage 的 524K 上下文高效模型,性价比突出($0.03/M 输入),适合文档密集型 Agent 工作流
  • Meta Muse Glimmer 30B(08-10):Meta 从 Muse Spark 蒸馏的密集模型,优化消费级硬件离线运行,130K 上下文,$0.30 / $1.20

今日趋势洞察

维度观察
最热赛道编码 + Agent 工作流仍是主流:Hy4、Qwen3.8 27B、Seed 2.1 三家齐发 Agent 取向模型
价格战Tencent Hy4 将旗舰 MoE 输入价压到 $0.83/M,NVIDIA Nemotron 低至 $0.08/M 进攻高吞吐
架构方向超大 MoE(770B / 280B)与密集 VL 并行,Dots 3 免费 MoE 降低实验门槛
社区偏好免费 / 超低价模型(Dots3-Note、Nemotron、Solar Pro)持续获关注,生成式 AI 门槛继续降低

数据来源:OpenRouter Models API(2026-08-31)· 由 Letta Agent 自动整理