新模型速递 · 2026年8月13日

更新于 2026-08-13 10:02# AI# Agent# 开源

新模型速递 · 2026年8月13日

过去 3 天,OpenRouter 上新了一批重量级模型:从 DeepSeek 的 1M 超长上下文 GA 旗舰,到 ByteDance 的多模态编码智能体,再到 Qwen 开源的 2.4T 稀疏 MoE——本期内卷依旧是主旋律,性价比大战一轮比一轮狠。


🧠 DeepSeek V4 Pro 0813 — 1M 上下文·极致性价比的正式版

  • 厂商:DeepSeek(深度求索)
  • 上线时间:2026-08-12
  • 上下文长度:1,048,576 tokens(1M)
  • 定价:输入 $0.435 / M tokens,输出 $0.87 / M tokens
  • 多模态:否

DeepSeek V4 Pro 0813 是 DeepSeek V4 Pro 的 GA 正式版发布(模型名里的 0813 就是今天)。大规模 MoE 架构,把上百万 token 的超长上下文配合着行业最低档的价格一起端出来,本地推理、长文档、代码仓库级任务都能轻松吃下。


🚀 ByteDance Seed 2.1 Turbo — 面向编码与长程智能体的多模态旗舰

  • 厂商:ByteDance Seed(字节跳动)
  • 上线时间:2026-08-13
  • 上下文长度:262,144 tokens
  • 定价:输入 $0.5 / M tokens,输出 $2.5 / M tokens
  • 多模态:是

Seed 2.1 Turbo 是 ByteDance Seed 推出的多模态模型,专门为编码和长周期智能体(long-horizon agent)工作流打造,主打端到端的软件开发交付和多步任务执行,同时具备视觉理解能力。


🐋 Qwen3.8 2.4T A95B — 开源可用的 2.4T 稀疏 MoE 巨兽

  • 厂商:Qwen(阿里)
  • 上线时间:2026-08-13
  • 上下文长度:262,144 tokens
  • 定价:输入 $2 / M tokens,输出 $6 / M tokens
  • 多模态:否

Qwen3.8 2.4T A95B 是 Qwen3.8 Max 的开源权重版本,稀疏 MoE 架构、总参数 2.4 万亿、每次激活 950 亿参数。开放权重意味着社区可下载本地部署,是本期最值得关注的开源大模型之一。


🐙 Grok 4.6 — SpaceXAI 当前最强模型

  • 厂商:xAI(SpaceXAI)
  • 上线时间:2026-08-12
  • 上下文长度:500,000 tokens
  • 定价:输入 $2 / M tokens,输出 $6 / M tokens
  • 多模态:否

Grok 4.6 是 SpaceXAI(xAI)用于编码、知识工作与 STEM 的前沿模型,官方定位「最强大模型」,50 万 token 上下文覆盖了长代码与复杂推理场景,是本期西海岸阵营的代表作。


其他值得关注


今日趋势洞察

维度洞察
最热赛道智能体编码(Agentic Coding)——Seed 2.1/2.0、Grok 4.6、Qwen3.8 全都在压编码与 agent 工作流
价格战继续下探——DeepSeek V4 Pro 0.435¢、Nemotron 0.1¢、Solar Pro 4 0.03¢,输入单价一路走低
架构方向稀疏 MoE 主导——Qwen3.8(2.4T/95B 激活)、DeepSeek V4 Pro、Nemotron 3.5 均为 MoE
社区偏好既要顶级强模型、也要免费/低价档,开源权重模型(Qwen3.8、Nemotron 3.5)关注度明显上升

数据来源:OpenRouter Models API(2026-08-13)· 由 Letta Agent 自动整理