跳过主要内容

新 AI 模型

各大实验室发布的每一个重要新 AI 模型,按时间倒序排列,整理自官方公告。按厂商与模型类型筛选,看清谁发布了什么、何时发布。

厂商
类型

共 698 条发布第 7 / 35 页

厂商模型名称发布时间链接
Qwen

Qwen3.5-Plus-2026-04-20

Qwen3.5-Plus-2026-04-20 是 Qwen3.5 原生视觉语言系列 Plus 档模型的日期快照版本,行为固定,适合对稳定性要求高的生产环境。相较 2 月 15 日快照,其 Agentic coding 能力与推理速度显著提升,知识、推理与长上下文能力保持较高水准,上下文窗口达 1M。适用于编码智能体、生产工作流与高吞吐场景。

2026年4月23日
FLUX

bfl.ai

bfl.ai 是 Black Forest Labs 的官方平台,提供 FLUX 系列图像生成与编辑模型。平台通过生产级 API 提供 FLUX.2 [pro] 与 FLUX.2 [flex],同时开源 32B 参数的 FLUX.2 [dev] 权重供自托管。模型支持 text-to-image 与多参考图编辑,文本渲染可靠、复杂 prompt 遵循准确,最高可输出 4MP 分辨率。开发者也可在浏览器 Playground 中直接试用。

2026年4月22日
Hunyuan

hy3-preview

Hy3-preview 是腾讯混元团队基于重建后的训练基础设施推出的预览版大语言模型。采用 MoE 架构,总参数 295B、激活参数 21B,context window 长达 256K。模型在复杂推理、编码与 agent 任务上提升明显,在 SWE-bench Verified、BrowseComp 等 benchmark 中取得具备竞争力的成绩,权重已按 Tencent Hy Community License 在 Hugging Face、ModelScope 开源。

2026年4月22日
OpenAI

OpenAI Privacy Filter

OpenAI Privacy Filter 是 OpenAI 发布的开放权重 PII 检测与遮盖模型,采用双向 token 分类架构,支持 128K token 上下文,可本地运行让敏感数据不离开设备。它按八类隐私标签识别非结构化文本中的个人信息,在 PII-Masking-300k 基准上修正标注后 F1 达 97.43%。模型以 Apache 2.0 许可在 Hugging Face 与 GitHub 开源,适用于训练数据、日志与索引等隐私流水线。

2026年4月22日
Qwen

Qwen3.6-27B

Qwen3.6-27B 是阿里巴巴通义 Qwen3.6 系列的 27B 原生视觉语言 Dense 模型,支持文本生成、深度思考与视觉理解。相较 3.5-27B,模型重点提升了 Agentic coding 能力,STEM 与推理能力进一步增强;视觉模态在空间智能、物体定位与检测上显著增强,视频理解、文档 OCR 及视觉 Agent 能力稳步提升。

2026年4月22日
Xiaomi

MiMo-V2.5

MiMo-V2.5 是小米于 2026 年 4 月发布的开源多模态大模型,采用 Sparse MoE 架构,总参数 310B、激活 15B,支持 1M context window,具备原生视觉与音频理解能力。它在 Claw-Eval 通用子集取得 62.3 分,视频理解与 Gemini 3 Pro 持平,多模态 agentic 表现比肩 Claude Sonnet 4.6。权重与模型卡已开放于 Hugging Face,适合编码与 agent 场景部署。

2026年4月22日
OpenAI

ChatGPT Images 2.0

ChatGPT Images 2.0 是 OpenAI 的新一代图像生成模型,API 名为 gpt-image-2,也是 OpenAI 首款具备思考能力的图像模型。其文字渲染与多语言生成能力显著提升,中文、日语、韩语等非拉丁文本准确流畅,可遵循复杂指令并处理密集文本、UI 元素等细节,API 输出最高 2K 分辨率。现已面向所有 ChatGPT 与 Codex 用户及 API 开放。

2026年4月21日
Qwen

HappyHorse-1.0-I2V

HappyHorse-1.0-I2V 是阿里云百炼推出的图生视频(image-to-video)模型,以单张首帧图片为基础,可搭配文本提示词引导,生成物理真实、运动流畅的高质量视频。输出覆盖 480P、720P、1080P 三档分辨率,时长 3 至 15 秒,宽高比自动跟随输入首帧,帧率 24fps(MP4 格式)。

2026年4月21日
Qwen

HappyHorse-1.0-T2V

HappyHorse-1.0-T2V 是阿里云百炼上线的文生视频模型,能够精准理解文本语义,生成动态画面高度还原、物理真实、运动流畅的高质量视频。模型输出 3 至 15 秒的 MP4 有声视频,支持 720P 与 1080P 两档分辨率、24 fps 帧率,并提供 16:9、9:16 等多种画幅比例,适合短视频创作与创意内容生产等场景。

2026年4月21日
Moonshot AI

Kimi K2.6

Kimi K2.6 是 Moonshot AI 开源的原生多模态 agentic 模型,采用总参数 1T 的 MoE 架构,每 token 激活 32B,context window 达 256K,支持图像与视频输入。模型主打长程编码、主动自主执行与 agent swarm 编排,可调度最多 300 个 sub-agent 并行协同完成复杂任务,在 SWE-Bench Pro、DeepSearchQA 和 HLE-Full(带工具)等 benchmark 上超过 GPT-5.4 与 Claude Opus 4.6。模型权重与代码均以 Modified MIT License 开源,支持 vLLM、SGLang 等推理引擎部署。

2026年4月20日
Grok

grok-4.3

grok-4.3 是 xAI 通过 API 提供的文本 LLM,官方称其为当时最快、最智能的模型,在 agentic tool calling 与 instruction following 榜单上领先。它支持 1M token 的 context window,提供 none、low、medium、high 四档 reasoning effort,输入输出定价 $1.25/$2.50 每 1M tokens,并作为 grok-3、Grok 4 Fast 等退役模型的官方迁移目标,适合工具调用型 agent 与长上下文任务。

2026年4月17日
Qwen

Qwen3.6-35B-A3B

Qwen3.6-35B-A3B 是阿里通义 Qwen3.6 系列的首个开放权重模型,属于原生视觉语言模型,采用线性注意力与稀疏 MoE 的混合架构,总参数 35B、每 token 激活 3B。原生 context window 为 262,144 tokens,可扩展至约 1M。相较 Qwen3.5-35B-A3B,其 agentic coding、数学与代码推理、空间智能以及物体定位与目标检测能力均有提升,模型以 Apache-2.0 许可开源发布。

2026年4月17日
Qwen

Qwen3.6-Flash

Qwen3.6-Flash 是阿里云百炼 Qwen3.6 原生视觉语言系列的 Flash 模型,支持图像、文本与视频输入,context window 长达 1M tokens。模型效果相较 3.5-Flash 显著提升,重点强化 agentic coding、数学推理与代码推理能力,空间智能及物体定位、目标检测同样明显增强。支持 Function Calling 与结构化输出,北京区输入价格 1.2 元/百万 tokens。

2026年4月17日
Qwen

Qwen3.6-Flash-2026-04-16

Qwen3.6-Flash-2026-04-16 是阿里通义 Qwen3.6 原生视觉语言系列的 Flash 档模型,支持文本生成、深度思考与视觉理解,效果较 3.5-Flash 显著提升。它重点强化 agentic coding,在多项代码智能体基准上大幅超越前代,数学推理与代码推理同步改进;视觉空间智能增强,物体定位与目标检测尤为突出。该日期快照版本适合对稳定性有要求的线上业务。

2026年4月17日
Anthropic

Claude Opus 4.7

Claude Opus 4.7 是 Anthropic 于 2026 年 4 月发布的 Opus 系列模型,直接升级自 Opus 4.6,面向高难度软件工程与长时间运行的 agent 任务。它在 CursorBench 上取得 70%,明显高于 Opus 4.6 的 58%,在 Rakuten-SWE-Bench 中完成的 production 任务约为前代 3 倍。图像输入同步增强,长边上限提升至 2,576 像素,为此前 Claude 模型的 3 倍以上。

2026年4月16日
Grok

grok-build-0.1

grok-build-0.1 是 xAI 专为 agentic coding 任务训练的编程模型,覆盖 web 开发、debugging 与 MCP 支持,现以 public beta 形式上线 xAI API,并作为同款模型驱动 Grok Build。其推理速度超过 100 tokens/秒,定价为输入 $1/百万 tokens、输出 $2/百万 tokens。除编程外,它也是通用 agentic 与 tool calling 场景中快速、经济的选择。

2026年4月16日
OpenAI

GPT-Rosalind

GPT-Rosalind 是 OpenAI 生命科学系列的首个前沿推理模型,面向生物学、药物研发与转化医学,针对科研工作流优化了工具调用,并加深对化学、蛋白质工程与基因组学的理解。它在 BixBench 评测中位居已公布分数模型的前列,并在 LABBench2 的 11 项任务中有 6 项优于 GPT-5.4。目前以研究预览形式通过受信访问计划在 ChatGPT、Codex 及 API 中向符合条件的客户开放。

2026年4月16日
Google

Gemini 3.1 Flash TTS

Google 于 2026 年 4 月 15 日推出 Gemini 3.1 Flash TTS(gemini-3.1-flash-tts-preview),一款经济实惠、低延迟且可控的文字转语音预览模型,支持单人与双人语音合成,内置 30 种预置音色。开发者可用自然语言提示控制风格、口音、语速与语气,并通过表现力音频标记实现精细的旁白控制。模型支持多语言输出与音频流式生成,适合播客、有声读物等需要精确朗读的场景。

2026年4月15日
Midjourney

V8.1

Midjourney V8.1 是 V8 系列图像生成模型的 alpha 迭代,延续 V7 的一贯美学,Moodboards 与 srefs 表现更加稳定。HD mode 提速 3 倍、成本降至三分之一并设为默认,标准分辨率生成快 50%、便宜 25%。新版恢复了 image prompts 与 image weights 等社区常用功能,并引入 Prompt Shortener 与更详细的 Describe。目前仅在 alpha.midjourney.com 开放早期测试。

2026年4月14日
Qwen

Qwen3.6-Max-Preview

Qwen3.6-Max-Preview 是阿里云 Qwen3.6 系列中规模最大、综合能力最强的 Max 模型 Preview 版本,当前开放纯文本能力供体验。相较 Qwen3-Max 与 Qwen3.6-Plus,其 vibe coding 与前端编程能力进一步提升,coding agent 执行更高效,长尾知识同步升级。模型提供 256K 上下文,支持思考模式与 Function Calling。

2026年4月14日

如何追踪新 AI 模型

四种读法,每一种都把新 AI 模型的发布时间线变成清晰的答案。按你的问题选一个视角。

01

先看最新发布

榜单把新 AI 模型按发布时间倒序排列,第一行永远是最新发布的那一个,无论来自哪家。每行都链接到官方公告,一次点击直达源头。日期为模型首次公开发布的日期。

02

追踪单一厂商

在厂商筛选里选定一家。OpenAI、Anthropic、Google、Meta、DeepSeek、Qwen 等 20+ 厂商各有专属视图。用它读懂一家厂商的发布节奏:多久发一次、押注哪类模型。

03

对比模型类型

按类型筛选:文本/LLM、多模态、图像生成、视频生成、音频/语音。类型分布能看出行业的发力方向:文本模型数量领先,图像与视频模型则成波次密集发布。逐月观察这个比例的变化。

04

补齐错过的发布

向前翻页回溯时间线。有的月份有几十个模型发布,存档可以回溯到 2017 年。这是一个完整的发布历史,而不只是新 AI 模型的当日动态。几次滚动就能还原任何一家厂商的全年动态。

新 AI 模型常见问题

榜单追踪什么、数据从哪来、怎么读。

榜单按发布时间倒序排列,第一行永远是最近一次发布,无论来自哪家。近几个月的新 AI 模型来自 OpenAI、Anthropic、Google、Qwen、智谱等实验室。每行都链接到官方公告,附确切发布日期。

目前覆盖 29 家厂商:OpenAI、Anthropic、Google、Meta、微软、亚马逊、NVIDIA、Mistral AI、DeepSeek、Qwen、月之暗面、智谱、字节跳动、xAI 等。海外与中国厂商在同一张榜单上,海外发布当天就能看到。

五类:文本/LLM、多模态、图像生成、视频生成、音频/语音。文本模型占发布数量的最大份额,图像与视频模型则成波次密集发布。类型筛选可以单独查看任意一类。

几乎不间断。主要厂商保持着周更节奏,繁忙的一周会发布不止一个新 AI 模型。2024 年以来节奏持续加快,官方公告一出,榜单就会新增对应条目。

每条记录采用首次公开发布的日期,即厂商官宣或向用户开放的当天。内测、传闻和论文预印本都不算。每条都链接到官方公告,日期可以自行验证。

可以。榜单同时是可回溯到 2017 年的存档。向前翻页能看到新 AI 模型发布节奏的爆发:从一年屈指可数到每年数百个。它是可检索的发布历史,而不只是实时信息流。

可以。厂商筛选可以把榜单收窄到一家或任意几家。再叠加类型筛选,可以回答很细的问题,比如某家厂商发布过的全部视频模型。

完全免费。所有发布记录、筛选和官方链接都可免费浏览,无需注册。榜单随新模型官宣而更新,每次发布会之后都值得回来看看。

数据整理自各厂商官方公告,发布时间为模型首次公开发布日期。