报告生成时间 · 2026-06-07 10:05:00 (Asia/Shanghai)
报告日期
2026-06-07
覆盖厂商
9
新增更新
37
生成时间
2026-06-07 10:05:00 (Asia/Shanghai)
快速跳转
OpenAI · 5 Anthropic Claude · 5 Claude Code (CLI) · 4 DeepSeek 深度求索 · 3 智谱 GLM · 4 通义 Qwen / 阿里 · 4 Kimi 月之暗面 (Moonshot) · 3 豆包 / 字节 Seed · 5 文心一言 / 百度 ERNIE · 4
OpenAI
美国 · 闭源 API · ChatGPT
5 项更新
近一个月围绕 GPT-5.5 旗舰模型展开生态扩张:上线 Amazon Bedrock 接入、Responses/Chat Completions 增加 moderation 分数、扩展企业级安全(Workload Identity Federation、Secure MCP Tunnel)。同时宣布弃用 reusable prompt objects、Evals 平台与 Agent Builder。
Responses API / Chat Completions 新增 moderation 分数 2026-06-04 API 功能
在 Responses API 和 Chat Completions API 中新增 moderation 对象支持。请求时传入 moderation 参数,即可在同一响应中同时拿到输入与输出两侧的 omni-moderation-latest 审查分数,便于构建内容安全闭环,无需再额外调用一次 moderation 接口。
查看原文 →
宣布弃用 reusable prompt objects / Evals / Agent Builder 2026-06-03 弃用
OpenAI 正式公告将关停 reusable prompt 对象、Evals 平台与 Agent Builder 三大开发者工具,并发布迁移时间表。已使用上述能力的客户需在窗口期内迁移至 Responses API + 新版 Prompting/Eval 方案。
查看原文 →
容器会话改为按分钟计费(5 分钟起) 2026-06-02 价格
Code Interpreter 等内置工具的容器会话从此前按完整 20 分钟会话计费,调整为按分钟计费、5 分钟起步。单分钟单价不变,但短任务(<5 分钟)的实际成本会下降数倍,对高并发但单次执行很短的工作流尤其友好。
查看原文 →
GPT-5.4 / GPT-5.5 登陆 Amazon Bedrock 2026-06-01 新模型
OpenAI 模型首次以 OpenAI 兼容的 Responses API 端点形式上架 Amazon Bedrock,目前覆盖 gpt-5.4、gpt-5.5。AWS 客户可直接在 Bedrock 控制台调用而无需走 OpenAI 直连,但具体可用模型/区域随 AWS Region 而异。
查看原文 →
正式发布 Workload Identity Federation + Admin API 扩展 2026-05-26 安全/企业
新增 Workload Identity Federation:可信工作负载可用外部签发的身份 Token 换取短期 OpenAI Access Token,无需再长期保存 API Key。同时 Admin API 增加对消费告警、模型白名单、数据保留策略、内置工具权限的细粒度管理与按行计费查询。
查看原文 →
数据源:https://platform.openai.com/docs/changelog
Anthropic Claude
美国 · 闭源 API · Claude.ai
5 项更新
5 月底到 6 月初最重磅的动作有两条:5 月 28 日发布 Opus 4.8 旗舰模型,同日宣布完成 650 亿美元 H 轮融资(投后估值 9650 亿美元);6 月 1 日 SEC 秘密递交 S-1 草案,意味着 Anthropic 已正式启动 IPO 程序。
发布 Claude Partner Network 的 Services Track 与 Partner Hub 2026-06-03 生态
Anthropic 扩充合作伙伴体系,新增专门面向交付/咨询服务商的 Services Track,并上线 Partner Hub 作为统一入口,用于撮合企业客户与认证的 Claude 集成商,配合 Claude Code Enterprise 的快速落地。
查看原文 →
Anthropic 向 SEC 秘密递交 S-1 草案启动 IPO 2026-06-01 公司动态
Anthropic 宣布已机密向美国证监会(SEC)递交 IPO 招股说明书 S-1 草案,这是公司迈向公开市场的关键一步。具体上市时间、发行规模和估值区间将依监管审核进展披露,但意味着 2026 年下半年可能出现一家千亿美元级的纯前沿 AI 公司公开发行。
查看原文 →
Claude Opus 4.8 旗舰模型正式发布 2026-05-28 新模型
Opus 类模型的又一次升级,Anthropic 称其在编码、智能体任务、专业工作上全面提升,并且具备「处理长时间运行任务」所需的一致性与稳定性。该模型已在 claude.ai 与 API 上线,模型 ID 沿用单一快照命名规范(自 4.6 起的统一约定)。
查看原文 →
完成 650 亿美元 H 轮融资,投后估值 9650 亿美元 2026-05-28 融资
Anthropic 宣布完成 H 轮 650 亿美元融资,post-money 估值达到 9650 亿美元,迫近万亿美元门槛,与 OpenAI 之间的资本竞赛进入新量级。融资用于扩大模型训练算力、Claude Code 企业方案与全球本地化(如同期新开的米兰、首尔办公室)。
查看原文 →
开设米兰办公室、任命韩国代表董事 2026-05-27 全球扩张
5 月 27 日宣布开设米兰办公室服务意大利企业/研究/开发者市场;5 月 26 日任命 KiYoung Choi 为韩国代表董事,为即将开业的首尔办公室做准备。这是 Anthropic 在欧亚地区企业市场的密集落子。
查看原文 →
数据源:https://www.anthropic.com/news
Claude Code (CLI)
美国 · 编码 Agent · 命令行工具
4 项更新
过去 30 天迭代到 2.1.168,密集修补 IDE/终端兼容性与远程会话稳定性。最重要的两项能力升级:新增 fallbackModel 链式回退(最多 3 个模型)、托管设置增加最小/最大版本约束。
2.1.166:新增 fallbackModel(最多 3 个)和 deny rule glob 支持 2026-06-05 新功能
新增 fallbackModel 配置项,可指定最多 3 个备选模型,主模型 overload 或不可用时按顺序回退,命令行 --fallback-model 也对交互式会话生效。同时 deny 规则的工具名位置支持 glob 通配(如 * 拒绝所有工具),允许规则拒绝非 MCP 通配符;启动时会对未知工具名给出警告。
查看原文 →
强化跨会话消息边界,自动模式拒绝转发的权限请求 2026-06-05 安全
针对来自其他 Claude 会话经 SendMessage 转发的消息:接收方不再继承发送方的 user authority,会拒绝由转发消息触发的权限请求;auto 模式下完全屏蔽此类请求。可显著降低多 Agent 协作场景下的越权风险。
查看原文 →
2.1.163:requiredMinimumVersion / requiredMaximumVersion 与 /plugin list 2026-06-02 企业管控
新增 requiredMinimumVersion 与 requiredMaximumVersion 两项托管设置:版本越界 Claude Code 直接拒绝启动并指引到允许版本,便于企业批量管控。同时新增 /plugin list 命令(支持 --enabled / --disabled 过滤),Hooks 的 Stop / SubagentStop 可返回 additionalContext 让 Claude 继续推进而不被标记为 hook error。
查看原文 →
修复 JetBrains 2026.1+ 终端闪烁、Kitty 键盘协议非 ASCII 输入丢失 2026-05-30 兼容性
通过启用 synchronized output 修复 IntelliJ / PyCharm / WebStorm 等 JetBrains 2026.1+ 终端闪烁;修复 WezTerm / Ghostty / Kitty 等使用 Kitty 键盘协议的终端中 Shift+非 ASCII 字符(如 Shift+ä → Ä)被丢弃的问题;同时修复 PowerShell 命令校验在 Windows 上偶发的长时间挂起。
查看原文 →
数据源:https://raw.githubusercontent.com/anthropics/claude-code/main/CHANGELOG.md
DeepSeek 深度求索
中国 · 开源权重 · API
3 项更新
4 月 24 日发布 V4 预览版,迈入百万 tokens 上下文普惠时代。V4-Pro 性能比肩顶级闭源模型,V4-Flash 主打经济款。同时旧 model 名 deepseek-chat / deepseek-reasoner 将于 2026-07-24 停用,需迁移到 deepseek-v4-pro / deepseek-v4-flash。
deepseek-v4-pro 缓存命中 token 价格降至 1 元/百万 2026-04-29 价格
在阿里云百炼直供通道上,deepseek-v4-pro 的 cached_token 单价调整为 1 元/百万 token,标准 input_token 单价不变。配合 V4 系列默认开启的上下文缓存,高频长 prompt(如 Agent 长任务)实际成本进一步下降。
查看原文 →
DeepSeek-V4 预览版发布:1M 上下文 + DSA 稀疏注意力 2026-04-24 新模型
V4 系列同步开源,分 Pro 与 Flash 两档,最大上下文均为 1,000,000 tokens;默认支持思考与非思考双模式,思考模式新增 reasoning_effort=high/max 参数。架构上首次结合 token 维度压缩 + DSA(DeepSeek Sparse Attention),大幅降低长上下文显存/算力开销。V4-Pro 在 Agentic Coding 上据称优于 Sonnet 4.5、接近 Opus 4.6 非思考模式;同时支持 OpenAI ChatCompletions 与 Anthropic 接口。
查看原文 →
旧模型名将于 2026-07-24 停用 2026-04-24 迁移
deepseek-chat 与 deepseek-reasoner 两个旧 model name 将于 2026-07-24 停止服务,过渡期内分别指向 deepseek-v4-flash 的非思考模式与思考模式。建议尽早切换到显式 v4-pro / v4-flash 调用以避免业务中断。
查看原文 →
数据源:https://api-docs.deepseek.com/zh-cn/news/news260424
智谱 GLM
中国 · 开源+API · 港股上市
4 项更新
近一个月发布节奏极快:4 月 7 日 GLM-5.1 旗舰上线,称综合能力对齐 Claude Opus 4.6;4 月 2 日 GLM-5V-Turbo 多模态 Coding 基座;3 月 15 日 GLM-5-Turbo 龙虾增强基座,全面押注 Agent / Coding 场景。
GLM-5.1 新一代旗舰:8 小时长程任务 + 对齐 Claude Opus 4.6 2026-04-07 新模型
GLM-5.1 上线 bigmodel.cn 与阿里云百炼。官方强调 Coding 与长程任务(Long Horizon Task)能力,称可在一次任务中独立持续工作长达 8 小时实现规划-执行-交付闭环;综合能力声称全面对齐 Claude Opus 4.6,是首个全面对齐的国产模型;通过 multi-turn SFT + RL + 过程质量评估强化稳定性与 tool use。
查看原文 →
GLM-5V-Turbo 多模态 Coding 基座模型 2026-04-02 多模态
面向 GUI Agent / Coding Agent 场景的小参数视觉-语言模型,细粒度理解、几何感知、空间理解显著增强;新增画框、截图、读网页(含图片)等多模态 Tools。适合「看懂环境-规划动作-执行任务」的长流程场景。
查看原文 →
GLM-5-Turbo 龙虾增强基座(OpenClaw 场景专用) 2026-03-15 Agent
面向 OpenClaw 龙虾场景深度优化,强化外部工具与 Skills 调用能力,多步任务中更稳定,能精准识别目标并支持多智能体协同分工。针对数据吞吐量大、逻辑链条长的龙虾任务提升执行效率与响应稳定性。
查看原文 →
GLM-5 旗舰发布:首次集成 DeepSeek Sparse Attention 2026-02-12 新模型
专为复杂系统工程与长程 Agent 任务设计,代码逻辑密度和系统工程能力对标 Claude Opus 4.5;首次集成 DeepSeek Sparse Attention,在保持长文本效果无损的同时显著提升 Token Efficiency。
查看原文 →
数据源:https://docs.bigmodel.cn/cn/update/new-releases
通义 Qwen / 阿里
中国 · 开源+API · 阿里云百炼
4 项更新
5 月密集发布 Qwen 3.7 系列:5 月 21 日 qwen3.7-max(纯文本旗舰),6 月 1 日 qwen3.7-plus(多模态混合智能体,可读屏幕操作 GUI、端到端导航移动 App)。5 月 19 日 livetranslate-flash-realtime 支持 60 语种识别 + 29 语种实时翻译。
qwen3.7-plus:多模态混合智能体,可操作 GUI 与移动 App 2026-06-01 新模型
千问 3.7-Plus 系列上线百炼。在强大文本能力的基础上全面升级视觉-语言能力,同时保持编码、工具使用、生产力工作流的完整智能体能力。核心特色是多模态交互混合智能体能力,能感知真实世界场景、读取屏幕并操作 GUI、基于视觉参考生成代码、端到端导航移动应用。
查看原文 →
qwen3.7-max 新一代纯文本旗舰 2026-05-21 新模型
Qwen Max 系列新一代旗舰模型上线。仅支持纯文本输入,默认开启思考模式,支持显式缓存。在编程、办公与生产力、长周期自主执行方面均能出色胜任各项任务,对标海外旗舰级闭源推理模型。
查看原文 →
qwen3.5-livetranslate-flash-realtime:60 语种实时音视频翻译 2026-05-19 新模型
多语言音视频实时翻译模型,可识别 60 种语言并实时翻译为 29 种语言的音频,适合直播、跨语种会议等场景。延迟与音色稳定性均做了实时化优化。
查看原文 →
百炼引入 MiMo-V2.5-Pro(小米)与 Step 3.7 Flash(阶跃) 2026-05-19 生态
阿里云百炼作为多厂商分发平台,5 月集中接入了小米直供的 MiMo-V2.5-Pro(通用 Agent + 复杂软件工程 + 长程任务能力提升)、阶跃星辰直供的 Step 3.7 Flash(搜索/Agent/编码/多模态全面升级),以及智谱直供的 GLM-5.1 / GLM-5。
查看原文 →
数据源:https://help.aliyun.com/zh/model-studio/model-release-notes
Kimi 月之暗面 (Moonshot)
中国 · 开源权重 · API + Kimi Code
3 项更新
4 月 20 日开源 Kimi K2.6,定位「最先进的开源编码 + 长程执行 + Agent Swarm」。官方案例:13 小时持续运行重构 8 年老项目 exchange-core,发起 1000+ 工具调用、修改 4000+ 行代码,吞吐提升 185%。
Kimi K2.6 开源发布:长程编码 + Agent Swarm 2026-04-20 新模型
Moonshot AI 开源 Kimi K2.6,聚焦 SOTA 级编码、长程执行、Agent Swarm 能力,已在 Kimi.com / App / API / Kimi Code 全面上线。在 Terminal-Bench 2.0、SWE-Bench Pro、SWE-Multilingual 等编码 Benchmark 上对比 K2.5 全面提升;案例显示其可在 Mac 上下载部署 Qwen3.5-0.8B,用 Zig 实现并优化推理,跨 4000+ 工具调用、12 小时持续执行将吞吐从 ~15 提至 ~193 tokens/sec,比 LM Studio 还快 ~20%。
查看原文 →
Kimi Agent Swarm:100 个子 Agent 横向扩展 2026-02-09 新能力
发布 Agent Swarm,主张 Scale Out(横向扩展子 Agent 数量)而非 Scale Up(单模型变大),通过最多 100 个子 Agent 并行协同完成复杂任务,配合 Kimi K2.5 / K2.6 在真实开发与研究工作流上的稳定性。
查看原文 →
WorldVQA:MLLM 的原子级世界知识基准 2026-02-03 评测
Kimi 团队发布 WorldVQA 评测,专注衡量多模态大模型对真实世界原子级知识的掌握程度,定位为 MLLM 实用化的能力评测新基准。
查看原文 →
数据源:https://www.kimi.com/blog/kimi-k2-6
豆包 / 字节 Seed
中国 · 闭源 API · 火山方舟
5 项更新
Seed 大模型团队近期主线在多模态生成与全模态理解:4 月 23 日发布 Seed3D 2.0 高精度 3D 生成、4 月 9 日 Seed 全双工语音大模型;2 月 14 日 Seed2.0 正式版(Pro / Lite / Mini 三档),4 月底 Lite 升级为字节首款全模态理解模型。
Seed3D 2.0 发布:更高精度、更强可用性 2026-04-23 新模型
字节 Seed 团队发布 Seed3D 2.0,聚焦更高精度的 3D 几何生成与材质表现,可用性显著提升,定位为面向工业设计/游戏/AIGC 场景的 3D 生成基础模型。
查看原文 →
Seed 全双工语音大模型发布:懂倾听、抗干扰 2026-04-09 新模型
Seeduplex 全双工语音大模型发布,可在对话过程中同时听与说(不再是「严格轮次」的半双工对话),抗背景干扰能力显著增强,走向更接近真人电话的自然交互体验。
查看原文 →
Seed2.0 正式发布:Pro / Lite / Mini 三档通用 Agent 模型 2026-02-14 新模型
Seed2.0 系列正式发布。Pro 主打长链路推理与复杂工作流鲁棒性;Lite 平衡输出质量与响应速度(4 月底再升级为全模态理解模型,支持视频/图像/音频/文本原生统一理解);Mini 主打推理吞吐和高并发部署密度。在 BabyVision 等视觉推理基准达到 SOTA,复杂 Agent 评测达业界第一梯队。
查看原文 →
Seedream 5.0 Lite:思考更深、生成更准的图像生成模型 2026-02-13 图像生成
Seedream 系列轻量版升级,强化生成前的「思考」阶段,复杂语义遵循和文字渲染能力提升明显,定位为高性价比文生图生产模型。
查看原文 →
Seedance 2.0 视频生成模型 2026-02-12 视频生成
采用统一的多模态音视频联合生成架构,支持文字/图片/音频/视频四种模态输入,集成业界最全面的多模态内容参考和编辑能力。在内部 SeedVideoBench-2.0 上,指令遵循、运动质量、画面美感、音频表现全维度处于行业领先。
查看原文 →
数据源:https://team.doubao.com/zh/blog
文心一言 / 百度 ERNIE
中国 · 开源+API · 百度千帆
4 项更新
5 月 9 日正式发布 ERNIE 5.1:仅以同类模型 6% 的预训练算力即取得领先性能,在 LMArena Search Arena 国内第 1。此前 4 月底 ERNIE-5.1-Preview 已在 LMArena Text Arena 拿下国内第 1、全球第 13。4 月 15 日发布 8B DiT 的 ERNIE-Image。
ERNIE 5.1 正式发布:6% 训练成本登顶多榜 2026-05-09 新模型
ERNIE 5.1 正式发布,以仅 6% 的同类模型预训练算力达到领先性能。底层采用「分离式全异步强化学习 + 扩规模 Agentic 后训练」方案,在 Agent、推理与创意能力上全面升级,在 LMArena Search Arena 中位列国内第 1。
查看原文 →
ERNIE-5.1-Preview 登顶 LMArena 国内第 1、全球第 13 2026-04-30 评测
在 4 月 30 日 LMArena 最新排行榜中,ERNIE-5.1-Preview 在 Text Arena 拿下中国模型第 1、全球第 13,并在多项细分类目进入全球前 10。
查看原文 →
ERNIE-Image 发布:8B DiT 单流文生图模型 2026-04-15 图像生成
百度发布 ERNIE-Image,文生图模型基于单流 Diffusion Transformer(DiT),DiT 参数量 8B,在开放权重模型中取得领先性能,是百度多模态生态在文生图方向上的最新进展。
查看原文 →
ERNIE 5.0:2.4 万亿参数全模态统一基础模型 2026-02-06 新模型
ERNIE 5.0 是从零训练的 2.4 万亿参数全模态统一模型,将文本、图像、视频、音频整合到单一自回归框架,突破了 late-fusion 架构的限制,实现真正的跨模态统一理解与生成。
查看原文 →
数据源:https://yiyan.baidu.com/blog/
⚠️ 说明
本报告由 Baby Q 自动抓取整理,内容仅供参考。新模型/API/价格变更以厂商官方公告为准。报告每日 10:00(北京时间)自动更新。