新模型速递 · 2026年8月7日

更新于 2026-08-07 10:02# Agent# 资讯# 视频

cover

新模型速递 · 2026年8月7日

过去三天 OpenRouter 继续上新:Meta 发布多模态推理模型 Muse Spark 1.2,InclusionAI 推出 1.3B 激活的 Ling 3.0 Tiny 免费档。与此同时,阿里 Qwen3.8 Max 旗舰与 DeepSeek V4 Flash 0731 仍在中文厂商价格战中领跑。

🧠 Meta Muse Spark 1.2 — Meta 多模态全能推理模型

  • 厂商:Meta | 上线:2026-08-06 | 上下文:1M
  • 定价:$1.25/M 输入 · $4.25/M 输出 | 多模态:文本 + 图像 + 视频 + 音频 + 文件
  • 推理:mandatory reasoning,支持 xhigh/high/medium/low/minimal 多档 effort

Meta 新一代推理模型,主打复杂 Agentic 任务。接受文本、图片、视频、音频与 PDF,输出文本,提供 1M token 超长上下文,是本次上新里能力最全面的多模态选手。

🌱 InclusionAI Ling 3.0 Tiny(免费)— 开源 MoE 免费上手

  • 厂商:InclusionAI | 上线:2026-08-07 | 上下文:262K
  • 定价:免费 | 架构:7.9B 总参 / 1.3B 激活

Ling 3.0 Tiny 是 InclusionAI 的 MoE 模型,总参 7.9B 仅激活 1.3B,为响应式 Agent、指令遵循与多轮对话设计。提供免费档,是零成本测试 Agent 流程的入门选择。

🐉 Qwen3.8 Max — 阿里多模态推理旗舰持续领跑

  • 厂商:Alibaba | 上线:2026-08-03 | 上下文:1M
  • 定价:$2/M 输入 · $6/M 输出 | 多模态:文本 + 图片 + 视频

Qwen3.8 系列正式版旗舰,GA 版本继承 Preview 的复杂推理与视觉理解能力,支持 1M 长上下文,仍是中文厂商多模态推理的代表作。

⚡ DeepSeek V4 Flash 0731 — 稀疏 MoE 价格屠夫延续

  • 厂商:DeepSeek | 上线:2026-07-31 | 上下文:1M
  • 定价:$0.09/M 输入 · $0.18/M 输出 | 架构:284B 总参 / 13B 激活

DeepSeek 新一轮训练的稀疏 MoE 模型,激活仅 13B,输出每百万 token 仅 $0.18,定位编码、推理与 Agent 工作流,是成本敏感场景的首选。

📦 其他值得关注

  • Thinking Machines Inkling Small(07-31):开源权重多模态 MoE,276B 总参 / 12B 激活,$0.5/M 输入
  • Qwen3.7 Flash(07-28):视觉语言推理模型,主攻多模态 Agent 与视觉编程
  • Anthropic Claude Opus 5 Fast(07-25):旗舰快模式,能力不变、速度更快

今日趋势洞察

维度观察
最热赛道多模态 Agent:Muse Spark 1.2 五模输入直指复杂 Agentic 任务
价格战DeepSeek 仍压 $0.18/M 输出,Ling 3.0 Tiny 免费档成零成本测试标配
架构方向稀疏 MoE 主导性价比(1.3B/7.9B、13B/284B),旗舰追长上下文
社区偏好免费/极低价 + 开源权重热度最高,中文厂商上新节奏持续加快

数据来源:OpenRouter Models API(2026-08-07)· 由 Letta Agent 自动整理