报告生成时间 · 2026-06-22 10:05:00 (Asia/Shanghai)
报告日期
2026-06-22
覆盖厂商
9
新增更新
25
生成时间
2026-06-22 10:05:00 (Asia/Shanghai)
快速跳转
OpenAI · 5 Anthropic Claude · 5 Claude Code (CLI) · 3 DeepSeek 深度求索 · 1 智谱 GLM · 2 通义 Qwen · 2 Kimi 月之暗面 · 3 豆包 / 字节 Seed · 2 文心一言 / 百度 · 2
OpenAI
美国 · 闭源 API · ChatGPT
5 项更新
OpenAI 近一个月以企业级能力与平台收敛为主线:旗舰 GPT-5.5(1M 上下文)已是生产推荐模型,模型上线 Amazon Bedrock,提示缓存默认延长至 24 小时;同时宣布弃用可复用 Prompt 对象、Evals 平台与 Agent Builder,并把容器会话改为按分钟计费。变更日志最新条目仍为 6 月 3 日,本期无更晚的新增公告。
宣布弃用可复用 Prompt 对象、Evals 平台与 Agent Builder 2026-06-03 弃用
OpenAI 在变更日志中宣布弃用 reusable prompt objects(可复用 Prompt 对象)、Evals 评估平台与 Agent Builder 三项能力,并在 deprecations 页面给出各自的关停时间线与迁移指引。这标志着平台从早期实验性工具向更聚焦的 Responses API / Agents SDK 体系收敛,开发者需按官方时间表迁移既有集成。
查看原文 →
容器会话改为按分钟计费(5 分钟起步) 2026-06-02 价格
自 2026 年 6 月 2 日起,符合条件的 Code Interpreter 容器会话由原先按整段 20 分钟会话计费,改为按分钟计费(5 分钟起步),每分钟单价保持不变。此调整让短会话计费更精细,可有效降低短任务的实际成本。
查看原文 →
OpenAI 模型上线 Amazon Bedrock(gpt-5.4 / gpt-5.5) 2026-06-01 API
OpenAI 模型现已通过兼容 Responses API 的端点在 Amazon Bedrock 上提供,调用路径为 v1/responses,覆盖 gpt-5.4、gpt-5.5 等。支持的模型与功能因 AWS 区域而异,便于已有 AWS 基础设施的企业在不出云的前提下直接调用 OpenAI 模型。
查看原文 →
提示缓存默认保留期延长至 24 小时 2026-05-29 API
对于未启用 ZDR(零数据保留)的组织,prompt_cache_retention 默认值由 in_memory 改为 24h,默认启用扩展提示缓存,覆盖 v1/responses、v1/chat/completions 与 v1/batch。对高频复用长提示的 Agent / RAG 工作负载可显著降低输入侧成本。
查看原文 →
发布 chat-latest 快照,生产环境推荐 GPT-5.5 2026-05-28 新模型
新增 chat-latest 快照,指向 ChatGPT 当前使用的最新 Instant 模型,底层快照会定期滚动更新。官方建议生产环境 API 统一使用 GPT-5.5——该旗舰模型支持 1M token 上下文窗口、图像输入、结构化输出、函数调用、内置计算机使用,以及 Skills / MCP / Web 搜索等能力。
查看原文 →
数据源:https://platform.openai.com/docs/changelog
Anthropic Claude
美国 · 闭源 API · Claude
5 项更新
本期 Anthropic 动态最密集:6 月 9 日发布迄今最强的 Fable 5 / Mythos 5(默认 1M 上下文、128k 输出),但 6 月 12 日遭美国政府出口管制指令暂停全部访问;同时新推 Claude Corps 人才计划、与 TCS / DXC 达成受监管行业合作、开设首尔办公室。当前可正常使用的旗舰仍为 5 月 28 日发布的 Claude Opus 4.8。
开设首尔办公室,深化韩国 AI 生态合作 2026-06-17 公司动态
Anthropic 宣布在首尔设立办公室,并公布与韩国 AI 生态多家伙伴的新合作,加速 Claude 在韩国市场的企业与开发者落地。这是继与 TCS、DXC 等达成受监管行业合作后,公司在亚太地区的进一步扩张。
查看原文 →
美国政府下令暂停 Fable 5 / Mythos 5 全部访问 2026-06-12 公司动态
美国政府发布出口管制指令,要求暂停对 Claude Fable 5 与 Mythos 5 的全部访问,Anthropic 就此发表官方声明说明合规配合情况及对相关研究访问的影响。两款旗舰模型在发布仅三天后即对外受限,是本期最受关注的监管事件;同日 Anthropic 还公布了首份 Anthropic Public Record 的相关结果。
查看原文 →
推出 Claude Corps 全国人才培养计划 2026-06-11 公司动态
Anthropic 启动 Claude Corps——一项面向职业生涯早期、热衷于把 AI 益处带给美国各地社区人群的全国性 fellowship 项目。该计划意在扩大 AI 普惠人才储备,是公司在 Economic Futures 等政策与公益布局之外,针对人才生态的新投入。
查看原文 →
携手 TCS、DXC 把 Claude 带入受监管行业 2026-06-11 合作
Anthropic 接连宣布与 TCS、DXC 两大 IT 服务巨头达成合作:DXC 将把 Claude 集成进银行、航空等受监管行业所依赖的系统,TCS 亦将携手 Anthropic 把 Claude 引入受监管行业场景。两项合作面向金融、航空等合规要求高的企业市场,进一步推动 Claude 在 B 端的规模化落地。
查看原文 →
发布 Claude Fable 5 与 Claude Mythos 5 2026-06-09 新模型
Anthropic 推出迄今最强的广泛发布模型 Claude Fable 5(claude-fable-5),以及面向 Project Glasswing 参与者的 Claude Mythos 5(claude-mythos-5)。两者默认支持 1M token 上下文窗口、128k 最大输出 token,并常驻「自适应思考」(不支持关闭思考、不支持手动思考预算与 assistant 预填)。二者沿用 Opus 4.7 引入的分词器,同样文本约多产生 30% token;Fable 5 在 Claude API 上要求 30 天数据保留,不支持零数据保留(ZDR)。注:该模型已于 6 月 12 日被美国政府出口管制指令暂停访问。
查看原文 →
数据源:https://www.anthropic.com/news
Claude Code (CLI)
美国 · 命令行 AI 编程工具
3 项更新
Claude Code 保持高频迭代,CHANGELOG 最新版本仍为 2.1.185。近期主线是 auto 模式安全加固(拦截破坏性 git / terraform / pulumi / cdk destroy 命令)、新增 /config key=value 即时配置语法、内置 Bun 运行时升级至 1.4,并修复大量 TUI、子智能体与 MCP 相关问题。
v2.1.185:流式停顿提示文案与触发时长调整 2026-06 功能
当 API 长时间无响应时,stream-stall 提示由「No response from API · Retrying in …」改为更准确的「Waiting for API response · will retry in …」,并将触发时间从静默 10 秒延长到 20 秒,减少正常等待被误报为失败的情况。
查看原文 →
v2.1.183:auto 模式安全加固 2026-06 安全
auto 模式下默认拦截破坏性 git 命令(git reset --hard、git checkout -- .、git clean -fd、git stash drop),当本轮提交并非本会话由智能体创建时阻止 git commit --amend,并默认拦截 terraform destroy / pulumi destroy / cdk destroy(除非明确指定栈)。同时新增对已弃用或被自动升级模型的告警,以及 /config --help 与 attribution.sessionUrl 设置。
查看原文 →
v2.1.181:/config key=value 即时配置与 Bun 1.4 2026-06 功能
新增 /config key=value 语法,可在交互模式、-p 打印模式及 Remote Control 中直接设置任意配置(如 /config thinking=false)。内置 Bun 运行时升级至 1.4,新增 CLAUDE_CLIENT_PRESENCE_FILE 环境变量在本机时抑制手机推送,并改进长段落逐行流式输出与 MCP OAuth 浏览器页样式。
查看原文 →
数据源:https://github.com/anthropics/claude-code/blob/main/CHANGELOG.md
DeepSeek 深度求索
中国 · 开源/API · 杭州深度求索
1 项更新
DeepSeek 当前主推 DeepSeek-V4:官网首页打出「DeepSeek-V4 预览版本发布,具备世界顶级推理性能,Agent 能力大幅提高」,API 已上线 V4-Pro 与 V4-Flash 两档。需注意官方更新日志中 V4 条目日期为 2026-04-24,距今已逾 30 天,期间未见更新的官方公告条目(如实标注,宁缺勿假)。
DeepSeek-V4 上线 API:V4-Pro 与 V4-Flash 两档 2026-04-24 新模型
DeepSeek API 新增 deepseek-v4-pro 与 deepseek-v4-flash 两个模型,可通过 OpenAI ChatCompletions 接口与 Anthropic 接口调用,base_url 保持不变。官网首页同步打出「DeepSeek-V4 预览版本发布」,已在网页端、App 与 API 上线。旧模型名 deepseek-chat 与 deepseek-reasoner 将于三个月后(2026-07-24)停用,当前阶段分别指向 v4-flash 的非思考与思考模式。该条为官方更新日志最新一条(已超 30 天窗口,本期无更新公告)。
查看原文 →
数据源:https://api-docs.deepseek.com/zh-cn/updates
智谱 GLM
中国 · 开源/API · 智谱 AI
2 项更新
智谱(Z.ai)当前旗舰为 GLM-5,主打智能体编程能力,官方称在 SWE-bench Verified、Terminal Bench 2.0 等核心榜单达到开源模型 SOTA、比肩 Claude Opus 4.5;产品线已扩展出 GLM-5-Turbo、GLM-5.2、GLM-4.6V(百亿级开源视觉推理)等型号。注:官方变更日志页(docs.bigmodel.cn/cn/changelog)当前返回 404,下列条目精确发布日期未能从带日期的官方渠道确认。
GLM-5 旗舰模型:智能体编程开源 SOTA 新模型
GLM-5 为智谱新一代全栈技术体系的旗舰基座模型,官方称其在 SWE-bench Verified、Terminal Bench 2.0 等智能体编程核心榜单上达到开源模型 SOTA,性能比肩 Claude Opus 4.5。配套推出 GLM-5-Turbo——专为「龙虾(AutoClaw)」场景打造、从训练层深度优化 Agent 核心能力,大幅提升工具调用与长链路执行能力。(以上为官网在售旗舰信息,未见带日期的官方变更日志佐证具体发布日。)
查看原文 →
GLM-5.2 / GLM-4.6V 与开放平台模型矩阵 API
智谱开放平台(bigmodel)已上线 GLM-5、GLM-5.2、GLM-4.7 等文本模型,并提供「迁移至 GLM-5.2」开发指引;多模态侧 GLM-4.6V 为全球 100B 级效果出众的开源视觉推理模型,视觉理解精度达同规模 SOTA、原生支持工具调用、支持 128K 长上下文。具体型号上线日期未在官方带日期日志中标注。
查看原文 →
数据源:https://www.zhipuai.cn/news
通义 Qwen
中国 · 开源/API · 阿里巴巴通义千问
2 项更新
通义千问新版官网博客(qwen.ai/blog)为前端渲染、无静态文本可抓,旧版 qwenlm.github.io 博客最新条目停留在 2025-09(Qwen3Guard)。依据阿里云百炼(Model Studio)在售模型目录,当前千问主力为 qwen3.7-max / qwen3.7-plus / qwen3.6-flash,并含全模态与图像视频生成矩阵;下列具体发布日期未能从官方带日期渠道确认(如实标注)。
千问 3.7 系列:qwen3.7-max / qwen3.7-plus / qwen3.6-flash 新模型
据阿里云百炼模型目录,千问文本模型当前从能力最强到成本最低依次为 qwen3.7-max、qwen3.7-plus、qwen3.6-flash,覆盖从旗舰推理到高性价比高并发的不同档位。该目录与千问模型 API 格式一致,同时也托管 deepseek-v4、kimi-k2.7-code、glm-5.2、MiniMax-M2.7 等三方模型。(发布日期未在官方带日期博客中确认。)
查看原文 →
全模态与图像/视频生成矩阵 新模型
多模态侧,千问提供 qwen3.5-omni-plus(全模态实时)与 qwen3.7-plus(图片/视频理解);生成侧含 qwen-image-2.0-pro 图像生成与 wan2.7-image-pro 等图像/视频生成模型,支持编辑、参考图与高分辨率输出。整体延续千问开源 + API 双轨、多模态全覆盖的路线。
查看原文 →
数据源:https://qwen.ai/blog
Kimi 月之暗面
中国 · API · 月之暗面 Moonshot AI
3 项更新
Kimi 开放平台近期上新 Kimi K2.7 Code——官方称为当前最强 Coding 模型,仅支持思考模式,并同步上线输出提速 5-6 倍的高速版;多模态旗舰 K2.6 支持文本/图片/视频与 256K 上下文。K2.7 Code 标准版定价约 ¥1.3~27 / 百万 tokens。开放平台首页今日仍挂「Kimi K2.7 Code 已正式发布」促销横幅。
发布 Kimi K2.7 Code(含高速版) 2026-06 新模型
Kimi K2.7 Code 是月之暗面迄今最智能的 Coding 模型,支持文本/图片/视频输入、仅支持思考模式、提供 256K 上下文窗口,擅长长上下文下的指令遵循与 Agent 任务。相比 K2.6,在 Kimi Code Bench v2 提升 21.8%、Program-Bench 提升 11%、MLS Bench Lite 提升 31.5%,Agentic 基准(Kimi Claw 24/7、MCP Atlas、MCP Mark Verified)约提升 10%。高速版(kimi-k2.7-code-highspeed)为同一模型、输出约 180 Token/s(短上下文可达 260 Token/s)。
查看原文 →
K2.7 Code 定价公布 2026-06 价格
kimi-k2.7-code 按每百万 tokens 计价:输入 ¥1.30(缓存命中)/ ¥6.50(缓存未命中),输出 ¥27.00,上下文 262,144 tokens;高速版 kimi-k2.7-code-highspeed 为输入 ¥2.60 / ¥13.00、输出 ¥54.00。两者均支持自动上下文缓存、Tool Calls、JSON Mode 与 Partial Mode。
查看原文 →
Kimi K2.6 多模态模型 2026-04-20 新模型
K2.6 是 Kimi 此前最新最智能的多模态模型,原生支持文本、图片与视频输入,提供 256K 上下文长度与思考模式,主打更强更稳的长程代码编写与 Agent 性能,赋能深度研究、一键建站、智能制表与 PPT 自主编辑等场景。
查看原文 →
数据源:https://platform.kimi.com/docs
豆包 / 字节 Seed
中国 · API · 字节跳动 · 火山引擎方舟
2 项更新
字节 Seed 研究团队近期成果集中在视觉/语音/3D:Seed3D 2.0、Seed 全双工语音、Seed2.0、Seedream 5.0 Lite、Seedance 2.0 等,这些模型也通过火山引擎方舟(Volcano Ark)对外提供 API。注:Seed 官方博客最新公开条目日期为 2026-04-23,距今已逾 30 天,本期未发现 30 天内的新公告(如实标注)。
Seed3D 2.0 发布:更高精度、更强可用性 2026-04-23 新模型
字节 Seed 团队发布 Seed3D 2.0,主打更高的生成精度与更强的工程可用性,面向 3D 内容生成场景。该模型为 Seed 博客当前最新一条公开模型发布记录(2026-04-23,已超 30 天窗口)。
查看原文 →
Seed 全双工语音大模型发布 2026-04-09 新模型
Seed 推出全双工语音大模型,主打「懂倾听、抗干扰」,可在用户说话与模型回应之间实现更自然的双向交互,推动语音交互向更类人的体验演进。配合 Seedance 2.0(视频生成)、Seedream 5.0 Lite(图像生成)等,构成 Seed 在多模态生成上的完整矩阵,并经火山引擎方舟对外提供调用。
查看原文 →
数据源:https://seed.bytedance.com/zh/blog
文心一言 / 百度
中国 · API · 百度智能云千帆
2 项更新
百度文心当前最新为 ERNIE 5.1(2026-05-09 正式发布),官方称仅以同级模型约 6% 的预训练成本即取得领先表现,在 Arena Search Arena 上位列中国第一;此前 ERNIE 5.0 为 2.4 万亿参数统一多模态模型。注:ERNIE 5.1 发布日 5-09 略早于 30 天窗口,为目前最新的官方公告,如实呈现,本期无更晚新增。
ERNIE 5.1 正式发布,多项榜单登顶 2026-05-09 新模型
文心 ERNIE 5.1 正式发布,官方称其仅以同级可比模型约 6% 的预训练成本即实现领先表现。依托「解耦式全异步强化学习」与「规模化智能体后训练」,ERNIE 5.1 在 Agent、推理与创意写作能力上全面升级,并在 Arena Search Arena 上位列中国第一。其预览版 ERNIE-5.1-Preview 此前(4-30)在 LMArena 文本榜位列中国模型第一、全球第 13。
查看原文 →
推出 ERNIE-Image 文生图模型 2026-04-15 新模型
ERNIE-Image 是基于单流 Diffusion Transformer(DiT)架构、DiT 参数量约 8B 的文生图模型,官方称在开源权重模型中取得领先表现。它延续了百度在多模态生成上的布局,与 2026-02-06 发布的 ERNIE 5.0(2.4 万亿参数统一多模态基座,融合文本/图像/视频/音频于单一自回归框架)共同构成文心的多模态矩阵。
查看原文 →
数据源:https://yiyan.baidu.com/blog
⚠️ 说明
本报告由 Baby Q 自动抓取整理,内容仅供参考。新模型/API/价格变更以厂商官方公告为准。报告每日 10:00(北京时间)自动更新。