报告生成时间 · 2026-06-12 10:06:00 (Asia/Shanghai)
报告日期
2026-06-12
覆盖厂商
9
新增更新
28
生成时间
2026-06-12 10:06:00 (Asia/Shanghai)
快速跳转
OpenAI · 5 Anthropic Claude · 5 Claude Code (CLI) · 5 DeepSeek 深度求索 · 1 智谱 GLM · 4 通义 Qwen · 1 Kimi 月之暗面 · 3 豆包 / 字节 Seed · 4 文心一言 / 百度
OpenAI
美国 · 闭源 API · ChatGPT
5 项更新
本周 OpenAI 持续打磨 Responses API 与计费体系:Container 会话改按分钟计费,可复用 Prompt 对象、Evals 平台与 Agent Builder 进入弃用流程,并新增内容审核接入。
弃用可复用 Prompt 对象 / Evals 平台 / Agent Builder 2026-06-03 弃用
OpenAI 在 6 月 3 日的 Changelog 中宣布对三类高层抽象进入弃用流程:Reusable Prompts(可在 Dashboard 创建并通过 prompt id 引用的模板)、Evals 平台与 Agent Builder。详细的关闭时间线与迁移指南将发布在 deprecations 页面,开发者需提前规划替代方案(Skills、客户自托管 evals 或直接使用 Responses API)。
查看原文 →
Container 会话改为按分钟计费(5 分钟起步) 2026-06-02 价格
自 2026-06-02 起,符合条件的 Container 会话将按分钟计费,最低 5 分钟起步,取代此前按 20 分钟整段计费的模式。每分钟单价保持不变,旨在让短任务的实际成本下降;具体内置工具价格仍以 API Pricing 页为准。
查看原文 →
GPT-5.4 / GPT-5.5 上架 Amazon Bedrock 2026-06-01 新模型
GPT-5.4 与 GPT-5.5 现可通过 Amazon Bedrock 的 OpenAI 兼容 Responses API 端点调用,覆盖 v1/responses 接口。具体可用模型与功能取决于 AWS 区域,企业可在不离开 AWS 安全边界的前提下接入 OpenAI 旗舰模型。
查看原文 →
Prompt 缓存保留期默认延长至 24h 2026-05-29 API
对于未启用 ZDR(零数据保留)的组织,prompt_cache_retention 参数默认从 in_memory 改为 24h,全面启用 Extended Prompt Caching。此举可显著降低重复前缀(如 system message、长文档)的 token 成本,对长对话与 RAG 工作负载尤其有利。
查看原文 →
chat-latest snapshot 上线 2026-05-28 新模型
OpenAI 推出 chat-latest 快照,指向 ChatGPT 当前使用的 Instant 模型,方便开发者测试 ChatGPT 内部最新改进。生产 API 仍推荐使用稳定的 GPT-5.5,chat-latest 后续将随 ChatGPT 更新自动滚动。
查看原文 →
数据源:https://platform.openai.com/docs/changelog
Anthropic Claude
美国 · 闭源 API · Claude.ai / Bedrock / Vertex
5 项更新
Anthropic 6 月一口气推出 Mythos 级旗舰 Fable 5、扩展企业渠道(与 DXC 战略合作、Partner Network 三档体系)并启动 Claude Corps 人才计划,配合 Project Glasswing 加大政府/防务侧布局。
DXC 将 Claude 集成进银行/航空等强监管行业核心系统 2026-06-11 企业
Anthropic 宣布与全球 IT 服务商 DXC Technology 战略合作,把 Claude 嵌入 DXC 服务的银行、航空、保险等强监管行业核心业务系统。DXC 将成为 Claude 进入大型企业遗留 IT 系统的关键集成商,配合 Anthropic 近期的 Partner Network 三档体系一起推进 To-B 渠道。
查看原文 →
推出 Claude Corps 人才孵化计划 2026-06-11 人才
Anthropic 启动 Claude Corps,一项面向职业早期人才的全国 fellowship 项目,目标是把 AI 红利带到美国各地社区。本质上是 Anthropic 在政策与公关层面对应 OpenAI 的人才 outreach 策略,配合 6 月 10 日发布的「Policy on the AI Exponential」一起推进。
查看原文 →
发布 Claude Fable 5 与 Claude Mythos 5 2026-06-09 新模型
Fable 5 是首个 Mythos 级、面向公众安全开放的模型,在软件工程、知识工作、视觉、科学研究等几乎所有评测上达到 SOTA,任务越长越复杂、相对其他模型的领先幅度越大。同期发布的 Mythos 5 是同一底层模型但放开了部分安全防护,先通过 Project Glasswing 交付给美国政府/防务侧的网络防御者使用,号称全球最强网络安全能力。Fable 5 默认走保守的安全过滤策略,约 5% 会话会被回退到 Opus 4.8 作答。
查看原文 →
Claude Partner Network 推出服务分级与 Partner Hub 2026-06-03 生态
Anthropic 把 Claude 合作伙伴体系正式拆成 Services Track(咨询/集成商)与新启用的 Partner Hub 门户,统一管理认证、案例与共同 GTM。配合 DXC 这种大集成商落地,意在让企业客户在选择 Claude 部署时有清晰的服务供应商目录。
查看原文 →
Anthropic 向 SEC 秘密递交 S-1 招股书 2026-06-01 公司
Anthropic 确认已向美国证监会(SEC)秘密递交 S-1 招股书草案,启动 IPO 流程;公司同月以 9650 亿美元投后估值完成 650 亿美元 H 轮融资。秘密递交意味着发行细节与财务信息暂不公开,正式启动路演前的窗口期仍有调整空间。
查看原文 →
数据源:https://www.anthropic.com/news
Claude Code (CLI)
美国 · Anthropic · 终端编程 Agent
5 项更新
本周连发 v2.1.173 / v2.1.174 两个 Patch 版本,重点修复 Fable 5 上线后衍生的边角问题:1M 上下文标签、/model 选单分层显示、Bedrock GovCloud 推理 profile 等;VSCode 集成新增 24h/7d 用量归因面板。
v2.1.174:/model 选单分层、Bedrock GovCloud 修复、VSCode 用量归因 2026-06-11 版本
新增 wheelScrollAccelerationEnabled 配置以关闭全屏模式下鼠标滚轮加速。/model 选单现在把 Default 解析到的模型族单独列出(Max/Team Premium/Enterprise 上 Opus 单行展示,Pro/Team 上 Sonnet 单行,PAYG 账户 Opus 单行)。修复 Bedrock GovCloud(us-gov-*)派生模型 ID 的 inference profile 前缀错用为 global 导致 400 的问题;修复后台会话从启动 daemon 的 shell 继承到错误 ANTHROPIC_* 环境变量的 bug。VSCode 端 /usage 面板新增 24h/7d 的 cache miss、长上下文、subagent、按 skill/agent/plugin/MCP 维度的用量归因。
查看原文 →
v2.1.173:Fable 5 模型名 [1m] 后缀规整 + Windows 沙箱误告警修复 2026-06-10 版本
修复 Fable 5 默认就带 1M 上下文却仍被附加 [1m] 后缀的命名重复问题,现已自动剥除。同时修掉 Windows 上启用 sandbox 设置时启动会出现的「sandbox dependencies missing」误告警。
查看原文 →
v2.1.172:子代理嵌套至 5 层 + 1M 上下文会话自愈 2026-06-08 版本
子代理现可自我嵌套至 5 层深度,更适合大型并行编排。Bedrock 现在会在 AWS_REGION 未设时回退读取 ~/.aws config(与 AWS SDK 一致),/status 会显示区域来源。1M 上下文场景下无 usage credits 导致会话永久卡死的问题已修复 —— 会自动 compact 回标准上下文限制内继续运行。同步新增 /plugin marketplace 搜索栏、OTEL 指标 lines_of_code.count 加入 model 维度。
查看原文 →
v2.1.170:CLI 接入 Claude Fable 5 2026-06-07 新模型
v2.1.170 起 Claude Code 支持调用 Claude Fable 5,需升级到该版本才能选用。同版本修复 VS Code 内置终端或继承 Claude Code 环境变量启动的 shell 中会话不保存 transcript(也不出现在 --resume 列表)的回归。
查看原文 →
v2.1.169:新增 --safe-mode、/cd 命令、post-session hook 2026-06-05 功能
Self-hosted runner 新增 post-session 生命周期钩子(会话结束、工作区销毁前触发,可用于快照未提交工作或导出日志);新增 --safe-mode 旗标(与 CLAUDE_CODE_SAFE_MODE 环境变量)以完全禁用 CLAUDE.md、plugins、skills、hooks、MCP servers,便于排障;新增 /cd 命令在不破坏 prompt cache 的前提下切换会话工作目录。
查看原文 →
数据源:https://raw.githubusercontent.com/anthropics/claude-code/main/CHANGELOG.md
DeepSeek 深度求索
中国 · 杭州 · API 自研旗舰
1 项更新
DeepSeek-V4 预览版本仍在主页大字宣传中,主打世界顶级推理性能与大幅提升的 Agent 能力,已在网页端、App 与 API 同步上线;API Docs 中文 news 页面当前 404,未抓到新增公告。
DeepSeek-V4 预览版本:顶级推理与 Agent 能力 2026-06-01 新模型
DeepSeek 官网首屏持续推送 DeepSeek-V4 预览版本:具备世界顶级推理性能,Agent 能力较 V3 系列大幅提升,并已在网页端、App 与 API 三端同步上线。具体的模型参数、上下文长度与价格细节未在主页直接列出,需进入 API 开放平台查看 V4 系列模型清单与计费。
查看原文 →
数据源:https://www.deepseek.com/
智谱 GLM
中国 · 北京 · GLM-5 / AutoGLM / 港股 02513
4 项更新
智谱主页继续以 GLM-5 系列作为旗舰主推:GLM-5 在 SWE-bench Verified 与 Terminal-Bench 2.0 上达到开源 SOTA,对标 Claude Opus 4.5;GLM-5-Turbo 针对 Agent 场景深度优化;GLM-4.6V 为 100B 级开源视觉推理模型。
GLM-5 系列保持开源 Agentic SOTA 主推位 2026-06-01 新模型
GLM-5 在 SWE-bench Verified、Terminal Bench 2.0 等智能体编程核心榜单上达到开源模型 SOTA,对标 Claude Opus 4.5;同期主推的 GLM-5-Turbo 专为「龙虾场景」(即 AutoClaw 桌面 Agent)打造,从训练层深度优化 Agent 核心能力,工具调用与长链路执行能力显著提升。
查看原文 →
GLM-4.6V:100B 级开源视觉推理模型 2026-06-01 新模型
GLM-4.6V 是全球 100B 参数量级中表现出众的开源视觉推理模型,原生支持工具调用,可自动完成多步骤任务,支持 128K 长上下文,定位与 GLM-5 文本旗舰互补。
查看原文 →
AutoClaw 桌面 Agent:1 分钟给每台电脑装上「小龙虾」 2026-06-01 产品
智谱在主页头图大力推广 AutoClaw —— 基于 GLM-5-Turbo 的桌面 Agent,号称 1 分钟可完成本地部署,定位为 To-C 个人电脑助理;与已有的 AutoGLM(自主规划/推理/执行的智能体模型)形成端云联动。
查看原文 →
智谱(02513.HK)2025 年度业绩发布会安排公告 2026-03-31 公司
智谱(香港联交所股票代码 02513)公告称将于 2026 年 3 月 31 日(星期二)公布截至 2025 年 12 月 31 日止年度的全年业绩。这是港股上市后首份完整财年业绩报告,市场关注其训练 / 推理成本结构与 To-B / To-C 收入拆分。
查看原文 →
数据源:https://www.zhipuai.cn/news
通义 Qwen
中国 · 杭州 · 阿里巴巴
1 项更新
Qwen 官方博客近 30 天无新增长篇文章,最新一篇仍是 2025-09-23 的 Qwen3Guard 安全护栏模型(含 0.6B/4B/8B 三档),qwen.ai/blog 与 chat.qwen.ai 走 SPA 渲染、本次未抓到结构化内容。
Qwen3Guard:首款安全护栏模型,支持流式实时检测 2025-09-23 新模型
基于 Qwen3 基础架构,针对安全分类任务专项微调,分 Qwen3Guard-Gen(生成式,适合离线打标/RL 奖励信号)与 Qwen3Guard-Stream(流式,可在逐 token 生成时实时审核)两版本,均提供 0.6B / 4B / 8B 三档参数。引入「安全 / 争议性 / 不安全」三级风险等级,可在严格 / 宽松模式间灵活切换;支持 119 种语言与方言,已开源至 Hugging Face / ModelScope,并接入阿里云 AI 安全护栏服务。
查看原文 →
数据源:https://qwenlm.github.io/zh/blog/
Kimi 月之暗面
中国 · 北京 · Moonshot
3 项更新
Moonshot 主页头条仍是 4 月发布的 Kimi K2.6 旗舰多模态模型,K2.6 已成为开放平台默认推荐;最新一条研究为 4 月的 Kimi K2.6。
Kimi K2.6 旗舰多模态模型 2026-04-20 新模型
Kimi K2.6 是 Moonshot 当前最新最智能的模型,原生多模态理解,支持文本、图片与视频输入,长程代码编写能力更强更稳定,支持 256K 上下文长度;已在 Kimi 网页端、App、桌面端(Mac / Windows)与 Kimi API 开放平台全面默认启用,配套产品线包括 Agent 集群、深度研究、Kimi Code、PPT / 表格 / 网站自动生成等。
查看原文 →
Agent Swarm:多智能体集群能力 2026-02-09 功能
Moonshot 研究团队发布 Agent Swarm,研究方向是多个 Kimi 智能体之间的协作调度与任务分解,配合 K2 系列在 Kimi App / 网页端的「Agent 集群」入口落地。
查看原文 →
WorldVQA:世界模型级视觉问答研究 2026-02-03 研究
Moonshot 研究团队发布 WorldVQA,探索把世界模型(World Model)能力注入视觉问答任务,提升模型对物理规律、时空关系的理解,是后续多模态产品形态的技术底座。
查看原文 →
数据源:https://www.moonshot.cn/
豆包 / 字节 Seed
中国 · 字节跳动 Seed 团队
4 项更新
Seed 团队最新动态仍以 4 月发布的 Seed3D 2.0(3D 内容生成 SOTA)与 Seeduplex(全双工语音)为主,模型矩阵新一代 Seed2.0 / Seedance 2.0 / Seedream 5.0 Lite 全面在火山方舟上线;近 30 天无重大新模型发布。
Seed3D 2.0 发布:3D 内容生成 SOTA 2026-04-23 新模型
Seed3D 2.0 在 Seed3D 1.0 基础上做了系统级升级:几何走 coarse-to-fine 两阶段管线 + locality-aware VAE,纹理与材质从级联管线改成统一 PBR 模型(直接生成多视图 albedo 与金属/粗糙度贴图),并引入 MoE scaling 与 VLM 语义条件。模型套件加入场景布局规划、零件感知拆分、训练-free 关节生成,可直接在物理 / 图形引擎中做 part-level 交互。与 5 个主流商用模型的人类偏好评测显示 69.0% – 89.9% 的胜率。
查看原文 →
Seeduplex 全双工语音大模型发布 2026-04-09 新模型
Seeduplex 是 Seed 团队推出的全双工语音大模型,强调「懂倾听、抗干扰」,可在用户说话过程中实时响应、被打断而不出错,是构建自然语音交互产品的关键底座。
查看原文 →
Seed2.0 正式发布 2026-02-14 新模型
Seed2.0 是字节跳动 Seed 团队新一代基座大模型,已在火山方舟 API 上架,是后续 Seedance / Seedream / Seeduplex 多模态家族的统一底座。
查看原文 →
Seedream 5.0 Lite 发布:思考更深、生成更准 2026-02-13 新模型
Seedream 5.0 Lite 是图像生成线的轻量化新成员,强调「思考」推理更深、生成结果更准确,与 Seedance 视频生成、Seeduplex 全双工语音共同构成豆包 / 火山方舟的多模态产品矩阵。
查看原文 →
数据源:https://team.doubao.com/zh/blog
文心一言 / 百度
中国 · 北京 · 百度智能云千帆
本期无新增
百度千帆文档中心当前仍是「全新的「百度千帆·大模型服务及 Agent 开发平台」」营销页,文心模型最新具体版本号、价格、上下文窗口未在抓到的页面上直接列出;近 30 天本次未抓到结构化的官方更新。
cloud.baidu.com/doc/WENXINWORKSHOP/index.html 与 yiyan.baidu.com 抓回的均为产品菜单/SPA 入口页,未含 30 天内可信的版本更新公告;本期未编造模型版本号。
数据源:https://cloud.baidu.com/doc/WENXINWORKSHOP/index.html
⚠️ 说明
本报告由 Baby Q 自动抓取整理,内容仅供参考。新模型/API/价格变更以厂商官方公告为准。报告每日 10:00(北京时间)自动更新。