跳过主要内容

新 AI 模型

各大实验室发布的每一个重要新 AI 模型,按时间倒序排列,整理自官方公告。按厂商与模型类型筛选,看清谁发布了什么、何时发布。

厂商
类型

共 698 条发布第 5 / 35 页

厂商模型名称发布时间链接
Qwen

Qwen3.7-Max-2026-06-08

Qwen3.7-Max-2026-06-08 是 Qwen3.7 系列中规模最大、综合能力最强的 Max 模型的日期快照版本,便于生产环境锁定稳定行为。相较 5 月 20 日快照,该版本新增视觉模态理解,能够感知真实世界场景,支持文本、图像、视频输入,上下文窗口达 1M,具备多模态交互混合智能体能力,适用于编程、办公与生产力、长周期自主执行等智能体任务。

2026年6月10日
Anthropic

Claude Fable 5

Claude Fable 5 是 Anthropic 于 2026 年 6 月发布的 Mythos 级旗舰模型,与同日的 Claude Mythos 5 共享底座,经安全防护处理后开放通用。官方称其在几乎所有已测 benchmark 上达到 state-of-the-art,任务越长越复杂领先越大,擅长软件工程、知识工作、视觉与科学研究,并比以往 Claude 模型更省 token。可通过 Claude API 以 claude-fable-5 调用,定价为每百万 tokens 输入 10 美元、输出 50 美元。

2026年6月9日
Anthropic

Claude Mythos 5

Claude Mythos 5 与 Claude Fable 5 共用同一底层模型,在部分领域解除安全护栏,属于能力高于 Opus 的 Mythos-class 层级。它通过 Project Glasswing 与美国政府合作部署,面向少量 cyberdefender 与关键基础设施提供商,官方称其网络安全能力居全球所有模型之首。内部测试中,它将药物设计部分流程提速约 10 倍,定价为每百万 token 输入 $10、输出 $50,不到 Mythos Preview 的一半。

2026年6月9日
Google

Gemma 4 12B

Gemma 4 12B 是 Google DeepMind 开源的 12B 档多模态模型,采用 encoder-free 架构,原生处理 text、image 与 audio 输入。它可在 16GB VRAM 或统一内存的笔记本上本地运行,性能接近同系列 26B MoE 模型而内存占用不到一半,context window 达 256K。权重以 Apache 2.0 协议发布,适合本地多模态 agent 与推理应用。

2026年6月9日
NVIDIA

Nemotron 3 Ultra (550B A55B)

NVIDIA Nemotron 3 Ultra 是面向长时 agent 推理与编排的开源 MoE 模型,总参数 550B,激活参数 55B,采用混合 Mamba-Transformer 架构,支持 1M token 上下文。据官方数据,其吞吐最高达同级开源模型的 5x,在 SWE-bench 与 Terminal-Bench 2.0 上任务完成成本最多降低约 30%。权重以 OpenMDW-1.1 许可开放,单一 NVFP4 checkpoint 即可部署于 Ampere、Hopper 和 Blackwell GPU。

2026年6月4日
Microsoft

MAI-Code-1-Flash

MAI-Code-1-Flash 是微软面向日常开发工作流的轻量级 agentic 代码模型,基于干净、可追溯的企业级数据从零训练,未从第三方模型蒸馏。官方评测中,它在 SWE-Bench Verified、SWE-Bench Pro、SWE-Bench Multilingual 和 Terminal Bench 2 上均优于 Claude Haiku 4.5,其中 SWE-Bench Pro 得分 51.2%(对比 35.2%),并能以最多减少 60% 的 token 解决更难的问题。模型可根据任务复杂度自适应分配推理开销,现正面向 VS Code 中的 GitHub Copilot 个人用户推送。

2026年6月2日
Microsoft

MAI-Thinking-1

MAI-Thinking-1 是 Microsoft AI 推出的推理模型,采用 35B 激活、约 1T 总参数的 sparse MoE 架构,提供 256k token 上下文与 function calling。它在 SWE-Bench Pro 上与 Claude Opus 4.6 表现相当,AIME 2025 达到 97.0%,并在合作方 Surge 的 1,276 项盲测任务中比 Claude Sonnet 4.6 更受用户偏好。训练未使用第三方模型蒸馏,数据可溯源,现已于 Microsoft Foundry 公开预览,适用于 agentic coding、数学推理等企业任务。

2026年6月2日
MiniMax

MiniMax M3

MiniMax M3 是 MiniMax 发布的 open-weight 文本模型,主打 coding 与 agentic 场景,原生支持图像和视频输入,context window 最高 1M tokens。模型采用自研 MSA(MiniMax Sparse Attention)稀疏注意力架构,在 1M context 下每 token 计算量约为上一代的 1/20。官方评测中 SWE-Bench Pro 达 59.0%、Terminal-Bench 2.1 达 66.0%,coding 能力较 M2 显著增强,可通过 MiniMax Code 与 API 使用。

2026年6月1日
Qwen

Qwen3.7-Plus

Qwen3.7-Plus 是 Qwen3.7 系列的高性价比 Plus 档模型。它在强文本能力上升级视觉语言能力,支持 1M 上下文,保有编码、工具使用与生产力工作流的完整智能体能力,可操作 GUI 并导航移动应用。适合 AI 编程、Agent 开发等场景。

2026年6月1日
Qwen

Qwen3.7-Plus-2026-05-26

通义 Qwen3.7 系列高性价比 Plus 模型的 2026-05-26 快照版本。模型在强文本能力基础上全面升级视觉-语言能力,支持 Image、Text、Video 输入,保留编码、工具使用与生产力工作流方面的完整智能体能力,可读取屏幕并操作 GUI、端到端导航移动应用。提供 1M token 上下文窗口,快照版本行为稳定,适合生产环境调用。

2026年6月1日
Anthropic

Claude Opus 4.8

Claude Opus 4.8 是 Anthropic 于 2026 年 5 月 28 日发布的 Opus 旗舰系列升级版本,在 coding、agentic 与 reasoning 各类 benchmark 上较 Opus 4.7 均有提升。新模型带来 effort control 强度调节、可在 Claude Code 中并行调度数百个 subagent 的 dynamic workflows,以及 2.5 倍速的 fast mode。官方评估显示其放行自身代码缺陷的概率约为前代的四分之一,API 定价与 4.7 持平,为每百万 input tokens 5 美元、output tokens 25 美元。

2026年5月28日
Grok

grok-imagine-video-1.5

grok-imagine-video-1.5 是 xAI Grok Imagine 系列的视频生成模型,已结束 preview 并正式上线 Imagine API。相比上一代,它的音频与物理表现改进明显:音效、环境声与对白随画面一次生成且同步更准,动作更连贯、变形更少,API 支持 1 至 15 秒时长与最高 1080p 分辨率。除 API 外,也可在 grok.com/imagine 及 Grok iOS、Android 应用中使用。

2026年5月27日
Grok

grok-imagine-video-1.5-preview

grok-imagine-video-1.5-preview 是 xAI Grok Imagine Video 1.5 的预览版 image-to-video 模型,在动作连贯、物理表现与音频质量上较上一代全面改进。它可在同一遍生成中输出音效、环境声与对白,语音更清晰且与画面同步更准,时长最长 15 秒、分辨率最高 1080p。Fast 版本约 25 秒即可生成 6 秒 720p 视频,正式版 grok-imagine-video-1.5 现已在 xAI API 及 grok.com/imagine 上线。

2026年5月27日
Hunyuan

hunyuan-mt2-1.8b-chat

Hy-MT2-1.8B 是腾讯混元 Hy-MT2 "快思考"多语种翻译系列的 1.8B 轻量档,支持 33 种语言互译,context 长度 8192,可执行术语约束、风格控制等翻译指令,官方评测中整体优于 Microsoft、豆包等主流商业翻译 API。经 AngelSlim 1.25-bit 量化后体积仅 440 MB,适合端侧部署,以 Apache 2.0 协议在 HuggingFace 和 ModelScope 开源。

2026年5月21日
Hunyuan

hunyuan-mt2-7b-chat

Hy-MT2-7B 是腾讯混元开源的多语言翻译模型,为 fast-thinking 翻译系列中的 7B 档,支持 33 种语言互译,max context 8192。官方评测显示,其在通用、商务及领域翻译任务上超过 DeepSeek-V4-Pro、Kimi K2.6 等开源模型,并支持术语约束、风格控制等指令跟随翻译能力。模型以 Apache 2.0 协议在 HuggingFace 与 ModelScope 开源,适合本地化部署与批量翻译场景。

2026年5月21日
Hunyuan

hunyuan-translation-pro-chat

腾讯混元 Hy-MT2 系列的旗舰商用翻译 API 档,对应 30B-A3B (MoE) 模型,面向专业领域等对译文质量要求较高的场景。该 fast-thinking 翻译模型重点支持 33 个语种互译,提供 8K 上下文,可遵循术语约束、风格控制、结构化数据等翻译指令。官方评测显示其在 fast-thinking 模式下超越 DeepSeek-V4-Pro、Kimi K2.6 等开源模型。

2026年5月21日
Qwen

Qwen3.7-Max

Qwen3.7-Max 是通义 Qwen3.7 系列中规模最大、综合能力最强的旗舰模型,面向智能体时代打造,当前开放纯文本能力供体验。核心优势是智能体能力的广度与深度,可胜任编程、办公与生产力、长周期自主执行等任务。支持 1M token 上下文与思考模式,北京区域每百万 token 输入 12 元、输出 36 元。

2026年5月21日
Qwen

Qwen3.7-Max-2026-05-20

Qwen3.7-Max-2026-05-20 是通义 Qwen3.7 系列中规模最大、综合能力最强的 Max 模型的 2026 年 5 月 20 日快照,支持文本生成与深度思考,当前开放纯文本能力供体验。Qwen3.7 是面向智能体时代的新一代旗舰模型,核心优势在于智能体能力的广度与深度,在编程、办公与生产力、长周期自主执行方面均能出色胜任各项任务。

2026年5月21日
Qwen

Qwen3.5-LiveTranslate-Flash-Realtime

Qwen3.5-LiveTranslate-Flash-Realtime 是通义千问的多语言实时音视频同传大模型,为 Qwen3.5-LiveTranslate-Flash 的实时版本,依托 Qwen3.5-Omni 基座。模型支持 60 种语言互译,其中 29 种可输出音频与文本,同传 latency 低至 2.8 秒,翻译质量接近离线结果。它可同时处理音频与图像输入,借助视觉上下文提升嘈杂环境下的翻译准确性,适用于实时视频流与本地视频文件。

2026年5月19日
Qwen

Qwen3.5-LiveTranslate-Flash-Realtime-2026-05-19

Qwen3.5-LiveTranslate-Flash-Realtime-2026-05-19 是通义千问的视觉增强型实时音视频同传模型,为 Qwen3.5-LiveTranslate-Flash 的实时版本,依托 Qwen3.5-Omni 基座构建。它支持 60 种语言互译,其中 29 种可输出音频,同传 latency 低至 2.8 秒,并能结合画面口型与文字等视觉信息提升嘈杂环境下的一词多义翻译准确性。模型适用于实时视频流、跨语言演讲与视频翻译等场景,该快照版本能力与官方稳定版等同,便于生产环境锁定版本。

2026年5月19日

如何追踪新 AI 模型

四种读法,每一种都把新 AI 模型的发布时间线变成清晰的答案。按你的问题选一个视角。

01

先看最新发布

榜单把新 AI 模型按发布时间倒序排列,第一行永远是最新发布的那一个,无论来自哪家。每行都链接到官方公告,一次点击直达源头。日期为模型首次公开发布的日期。

02

追踪单一厂商

在厂商筛选里选定一家。OpenAI、Anthropic、Google、Meta、DeepSeek、Qwen 等 20+ 厂商各有专属视图。用它读懂一家厂商的发布节奏:多久发一次、押注哪类模型。

03

对比模型类型

按类型筛选:文本/LLM、多模态、图像生成、视频生成、音频/语音。类型分布能看出行业的发力方向:文本模型数量领先,图像与视频模型则成波次密集发布。逐月观察这个比例的变化。

04

补齐错过的发布

向前翻页回溯时间线。有的月份有几十个模型发布,存档可以回溯到 2017 年。这是一个完整的发布历史,而不只是新 AI 模型的当日动态。几次滚动就能还原任何一家厂商的全年动态。

新 AI 模型常见问题

榜单追踪什么、数据从哪来、怎么读。

榜单按发布时间倒序排列,第一行永远是最近一次发布,无论来自哪家。近几个月的新 AI 模型来自 OpenAI、Anthropic、Google、Qwen、智谱等实验室。每行都链接到官方公告,附确切发布日期。

目前覆盖 29 家厂商:OpenAI、Anthropic、Google、Meta、微软、亚马逊、NVIDIA、Mistral AI、DeepSeek、Qwen、月之暗面、智谱、字节跳动、xAI 等。海外与中国厂商在同一张榜单上,海外发布当天就能看到。

五类:文本/LLM、多模态、图像生成、视频生成、音频/语音。文本模型占发布数量的最大份额,图像与视频模型则成波次密集发布。类型筛选可以单独查看任意一类。

几乎不间断。主要厂商保持着周更节奏,繁忙的一周会发布不止一个新 AI 模型。2024 年以来节奏持续加快,官方公告一出,榜单就会新增对应条目。

每条记录采用首次公开发布的日期,即厂商官宣或向用户开放的当天。内测、传闻和论文预印本都不算。每条都链接到官方公告,日期可以自行验证。

可以。榜单同时是可回溯到 2017 年的存档。向前翻页能看到新 AI 模型发布节奏的爆发:从一年屈指可数到每年数百个。它是可检索的发布历史,而不只是实时信息流。

可以。厂商筛选可以把榜单收窄到一家或任意几家。再叠加类型筛选,可以回答很细的问题,比如某家厂商发布过的全部视频模型。

完全免费。所有发布记录、筛选和官方链接都可免费浏览,无需注册。榜单随新模型官宣而更新,每次发布会之后都值得回来看看。

数据整理自各厂商官方公告,发布时间为模型首次公开发布日期。