报告生成时间 · 2026-06-23 10:15:37 (Asia/Shanghai)
报告日期
2026-06-23
覆盖厂商
9
新增更新
18
生成时间
2026-06-23 10:15:37 (Asia/Shanghai)
快速跳转
OpenAI · 4 Anthropic Claude · 4 Claude Code (CLI) · 2 DeepSeek 深度求索 · 1 智谱 GLM · 2 通义 Qwen · 2 Kimi 月之暗面 · 2 豆包 / 字节 Seed 文心一言 / 百度 · 1
OpenAI
美国 · 闭源 API · ChatGPT
4 项更新
当前旗舰为 GPT-5.5(4 月发布,1M 上下文)。近 30 天 changelog 以 API 平台能力打磨为主:Web 搜索工具支持返回图像结果、模型上线 Amazon Bedrock、容器会话改为按分钟计费、提示缓存默认延长至 24 小时。
Web 搜索工具支持返回图像结果 2026-06-09 功能
OpenAI 在 v1/responses 的 Web search 工具上新增图像结果返回能力,可在常规文本结果之外同时返回与查询相关的图片,适用于需要实时或网络实证视觉素材的场景(如商品图、地标、地点、活动或视觉参考)。该能力面向构建带检索增强的多模态应用,无需额外 beta header。
查看原文 →
GPT-5.4 / GPT-5.5 上线 Amazon Bedrock 2026-06-01 API
OpenAI 模型(含 gpt-5.4、gpt-5.5)开始通过 Amazon Bedrock 对外提供,便于已在 AWS 体系内的企业直接调用。其中 GPT-5.5 为面向复杂专业工作的前沿模型,支持 1M token 上下文、图像输入、结构化输出、函数调用、提示缓存、Batch、工具检索、内置 computer use、hosted shell、apply patch、Skills、MCP 与 Web 搜索。
查看原文 →
代码解释器容器会话改为按分钟计费 2026-06-02 价格
自 6 月 2 日起,符合条件的容器会话按分钟计费(5 分钟起步),替代此前按 20 分钟整段会话计费的方式,每分钟单价保持不变。此举使短会话计费更精细,可降低短任务的实际成本。具体内置工具价格以官方 API 定价文档为准。
查看原文 →
提示缓存默认延长至 24 小时(扩展缓存) 2026-05-29 功能
对于未启用 ZDR 的组织,v1/responses、v1/chat/completions 与 v1/batch 的 prompt_cache_retention 默认值由 in_memory 改为 24h,默认启用扩展提示缓存,有助于在多轮、长会话场景下降低重复输入成本。同期还发布了 chat-latest 快照,指向 ChatGPT 当前所用的 Instant 模型。
查看原文 →
数据源:https://platform.openai.com/docs/changelog
Anthropic Claude
美国 · 闭源 API · Claude
4 项更新
本期最重磅:6 月 9 日发布新一代最强模型 Claude Fable 5 与 Claude Mythos 5(默认 1M 上下文、128k 最大输出、常驻自适应思考)。此外美国政府就 Fable 5 / Mythos 5 下发出口管制暂停访问指令,公司亦启动 Claude Corps 奖学金并在首尔设立办公室。
发布 Claude Fable 5 与 Claude Mythos 5 2026-06-09 新模型
Anthropic 推出迄今最强的广泛可用模型 Claude Fable 5(claude-fable-5),并面向 Project Glasswing 参与者推出 Claude Mythos 5(claude-mythos-5)。两款模型默认支持 1M token 上下文、最大 128k 输出 token,并具备常驻的自适应思考(always-on adaptive thinking)。二者沿用 Claude Opus 4.7 引入的分词器,相同文本的 token 数较更早模型约多 30%;Fable 5 在请求与生成过程中运行安全分类器,被拒请求返回 stop_reason 为 refusal。
查看原文 →
就美政府暂停 Fable 5 / Mythos 5 访问指令发表声明 2026-06-12 公司动态
美国政府发布出口管制指令,要求暂停对 Claude Fable 5 与 Claude Mythos 5 的全部访问,Anthropic 就此发表官方声明。这是继 6 月 9 日两款旗舰模型发布后的重大监管事件,反映前沿模型与出口管制政策之间日益加深的张力。
查看原文 →
退役 Claude Sonnet 4 与 Claude Opus 4 2026-06-15 API
Anthropic 正式下线 claude-sonnet-4-20250514 与 claude-opus-4-20250514,对这两个模型的请求将直接返回错误,官方建议分别升级至 Claude Sonnet 4.6 与 Claude Opus 4.8。研究人员可通过 External Researcher Access Program 申请继续访问。
查看原文 →
开设首尔办公室并扩大韩国 AI 生态合作 2026-06-17 公司动态
Anthropic 宣布在首尔设立办公室,并在韩国 AI 生态内达成多项新合作。同期还推出面向职业生涯早期人群的全国性奖学金项目 Claude Corps(6 月 11 日),延续其在政策、产业与人才侧的布局。
查看原文 →
数据源:https://www.anthropic.com/news
Claude Code (CLI)
美国 · 开发者 CLI · Anthropic
2 项更新
命令行编程助手保持高频迭代,最新版本 2.1.186。本期重点是 MCP 登录/登出走 CLI、!bash 命令输出可自动触发模型响应,以及 auto 模式安全加固(拦截破坏性 git / terraform / pulumi / cdk destroy 操作)。
v2.1.186:CLI 直连 MCP 鉴权与 bash 自动响应 2026-06 功能
新增 claude mcp login / logout 子命令,可在不打开交互式 /mcp 菜单的情况下完成 MCP 服务器鉴权,并支持 --no-browser 经 SSH 完成;/workflows 智能体详情视图支持按状态过滤(按 f),/plugin 已安装页新增 Skills 区。此外 !bash 命令的输出现在会自动触发 Claude 进行回应,可通过设置 respondToBashCommands 为 false 恢复旧的仅作上下文行为。
查看原文 →
v2.1.183:auto 模式安全加固 2026-06 安全
在自动模式下,当用户未明确要求丢弃本地改动时,破坏性 git 命令(git reset --hard、git checkout -- .、git clean -fd、git stash drop)将被拦截;非本会话由 agent 提交的 commit 上禁止 git commit --amend;terraform destroy / pulumi destroy / cdk destroy 除非指明具体 stack 否则一律拦截。同时新增对已弃用或被自动升级模型的告警,并覆盖 agent frontmatter 中设置的模型。
查看原文 →
数据源:https://raw.githubusercontent.com/anthropics/claude-code/main/CHANGELOG.md
DeepSeek 深度求索
中国 · 开源/API · 杭州深度求索
1 项更新
当前主推 DeepSeek-V4:官网首页打出「DeepSeek-V4 预览版本发布,具备世界顶级推理性能,Agent 能力大幅提高」。需如实说明:官方更新日志中 V4 条目日期为 2026-04-24,已逾 30 天窗口,期间未见更新的官方公告条目(宁缺勿假)。
DeepSeek-V4 上线 API:V4-Pro 与 V4-Flash 两档 2026-04-24 新模型
DeepSeek API 已支持 deepseek-v4-pro 与 deepseek-v4-flash 两档模型,base_url 不变、仅需将 model 参数改为对应名称,并同时兼容 OpenAI ChatCompletions 接口与 Anthropic 接口。旧模型名 deepseek-chat 与 deepseek-reasoner 将于 2026-07-24 停用,当前阶段分别指向 deepseek-v4-flash 的非思考模式与思考模式。官网将 V4 定位为「世界顶级推理性能、Agent 能力大幅提高」,并已在网页端、APP 与 API 全量上线。
查看原文 →
数据源:https://api-docs.deepseek.com/zh-cn/news/news
智谱 GLM
中国 · 开源/API · 智谱AI(Z.ai)
2 项更新
本期国内最强信号:6 月 16 日 GLM-5.2 上线并开源,主打「真正可用的 1M 上下文」与长程 Coding Agent,在 Artificial Analysis 综合榜取得 51 分、与 Anthropic、OpenAI 并列前三,为开源模型 SOTA。
GLM-5.2 新一代旗舰模型上线并开源 2026-06-16 新模型
智谱发布并开源新一代旗舰 GLM-5.2,定位面向长任务时代的旗舰基座模型。支持 1M 无损上下文(Solid 1M),实测可承载项目级工程上下文,长程任务执行更稳定、显著减少复杂任务中的上下文漂移与目标遗忘。在 Artificial Analysis 综合榜单取得 51 分,与 Anthropic、OpenAI 并列前三、为开源模型 SOTA;Coding 与长程任务评测达到开源 SOTA,可在一次任务内完成「从需求到多端可部署产物」的完整开发链路。
查看原文 →
GLM Coding Plan 团队版上线 2026-05-29 产品
智谱推出 GLM Coding Plan 团队版,让组织在安全可控的前提下统一接入 GLM 编码能力、提升开发效率,并已同步上线 GLM-5.2。配合 GLM-5V-Turbo(多模态 Coding 模型)与 GLM-5-Turbo(Agent 增强基座),构成面向工程与智能体场景的模型矩阵。
查看原文 →
数据源:https://docs.bigmodel.cn/cn/update/new-releases.md
通义 Qwen
中国 · 开源/API · 阿里巴巴通义千问
2 项更新
通义新版官网博客(qwen.ai/blog)为纯前端渲染、无静态文本可抓,旧版 qwenlm.github.io 最新条目停留在 2025-09。以下依据今日实测的阿里云百炼(Model Studio)在售模型目录整理,当前主力为 qwen3.7 系列;具体发布日期未能从官方带日期渠道确认,如实标注。
千问 3.7 文本系列:qwen3.7-max / qwen3.7-plus / qwen3.6-flash 新模型
据今日实测的阿里云百炼模型目录,千问文本模型当前从能力最强到成本最低依次为 qwen3.7-max、qwen3.7-plus、qwen3.6-flash,覆盖旗舰推理到高性价比高并发的不同档位。该目录与千问模型 API 格式一致,同时也托管 deepseek-v4、kimi-k2.7-code、glm-5.2 等三方模型。具体上线日期未在官方带日期博客中确认,故日期留空、不臆测。
查看原文 →
全模态与图像/视频生成矩阵 多模态
多模态侧,千问提供 qwen3.5-omni-plus(全模态实时,含 realtime 版本)与图片/视频理解能力;生成侧含 qwen-image-2.0-pro 图像生成与 wan2.7-image-pro 等图像/视频生成模型,支持编辑、参考图与高分辨率输出。整体延续千问「开源 + API」双轨、多模态全覆盖的路线。以上同样基于在售模型目录,未含官方带日期公告。
查看原文 →
数据源:https://qwen.ai/blog
Kimi 月之暗面
中国 · API · 月之暗面 Moonshot AI
2 项更新
Kimi 近期发布当前最强 Coding 模型 K2.7 Code(平台文档于 2026-06-17 更新):256K 上下文、支持文本/图片/视频输入与思考模式,并同步上线输出速度约 5-6 倍的高速版。多项编码基准较 K2.6 显著提升。
Kimi K2.7 Code 正式发布(当前最强 Coding 模型) 2026-06-17 新模型
Kimi K2.7 Code 是月之暗面迄今最智能的 Coding 模型,在长上下文中更可靠地遵循指令、以更高成功率完成编程任务,支持文本/图片/视频输入、思考模式以及对话与 Agent 任务,上下文窗口 256K(262,144 tokens)。相比 K2.6,Kimi Code Bench v2 提升 21.8%、Program-Bench 提升 11%、MLS Bench Lite 提升 31.5%。同步推出高速版 kimi-k2.7-code-highspeed,输出速度约为普通版 5-6 倍,常规编程场景约 180 Token/s、短上下文可达 260 Token/s(日期取平台文档最近更新日 2026-06-17)。
查看原文 →
K2.7 Code 定价公布 2026-06-17 价格
按每 1M tokens 计费:kimi-k2.7-code 输入 ¥1.30(缓存命中)/ ¥6.50(缓存未命中)、输出 ¥27.00,上下文窗口 262,144 tokens;高速版 kimi-k2.7-code-highspeed 输入 ¥2.60 / ¥13.00、输出 ¥54.00,同为 256K 上下文。此前的 K2.6 为多模态旗舰,同样支持 256K 上下文与文本/图片/视频输入。
查看原文 →
数据源:https://platform.moonshot.cn/docs/api/changelog
豆包 / 字节 Seed
中国 · API · 字节跳动 · 火山引擎方舟
本期无新增
字节 Seed 官方博客最新公开条目为 2026-04-23(Seed3D 2.0),已逾 30 天窗口,本期未见 30 天内的新博客公告。火山引擎方舟模型目录中已出现 doubao-seed-2-0 系列与 doubao-seed-2-1 预览快照,但缺少官方带日期发布说明,故不据快照 ID 臆断发布事实。
Seed 官方博客最新条目日期为 2026-04-23(Seed3D 2.0),距今已逾 30 天,本期无 30 天内的新公告。火山引擎方舟目录虽含 doubao-seed-2-1-pro / turbo 等快照,但无官方带日期发布文档佐证,按「宁缺勿假」不列为已发布更新。
数据源:https://team.doubao.com/zh/blog
文心一言 / 百度
中国 · 开源/API · 百度智能云千帆
1 项更新
百度当前旗舰为 ERNIE 5.1(2026-05-09 正式发布),仅以约 6% 的预训练成本即达到同级领先性能,在国内 Arena Search Arena 排名第一。需如实说明:该发布日期略超 30 天窗口,期间未见更新的官方旗舰公告。
ERNIE 5.1 正式发布,多榜领先 2026-05-09 新模型
百度文心 ERNIE 5.1 正式发布,仅以同级模型约 6% 的预训练成本达到领先性能。借助解耦的全异步强化学习(disaggregated fully-asynchronous RL)与规模化的 agentic 后训练,ERNIE 5.1 在 Agent、推理与创意能力上全面升级,并在国内 Arena Search Arena 上排名第一。其预览版 ERNIE-5.1-Preview 此前(4 月 30 日)已登顶 LMArena 中文模型第一、全球第 13。
查看原文 →
数据源:https://yiyan.baidu.com/blog
⚠️ 说明
本报告由 Baby Q 自动抓取整理,内容仅供参考。新模型/API/价格变更以厂商官方公告为准。报告每日 10:00(北京时间)自动更新。