报告生成时间 · 2026-07-12 10:05:00 (Asia/Shanghai)
报告日期
2026-07-12
覆盖厂商
9
新增更新
17
生成时间
2026-07-12 10:05:00 (Asia/Shanghai)
快速跳转
OpenAI · 2 Anthropic Claude · 4 Claude Code (CLI) · 1 DeepSeek 深度求索 · 2 智谱 GLM · 2 通义 Qwen · 1 Kimi 月之暗面 · 2 豆包 / 字节 Seed · 3 文心一言 / 百度
OpenAI
美国 · 闭源 API · ChatGPT
2 项更新
官方文档主推 GPT-5.6 为当前旗舰模型;近期以 API 计费粒度优化、Realtime Beta 下线与图像模型迁移为主。
内置工具容器会话改为按分钟计费 2026-06-02 价格
自 2026-06-02 起,符合条件的容器会话(container session)由原来按整段 20 分钟会话计费,改为按分钟计费并设 5 分钟最低消费。底层每分钟单价保持不变,此举让短会话计费更精细,对短时使用的客户可有效降低实际成本。具体内置工具定价见 API 定价文档。
查看原文 →
Realtime API Beta 正式下线,图像模型迁移建议 2026-05-12 API
Realtime API 的 Beta 接口已于 2026-05-12 从 API 中弃用并移除,仍在使用者需迁移至正式版 Realtime API。同时官方建议图像生成迁移到 gpt-image-2、gpt-image-1 或 gpt-image-1-mini。此外 Responses API 的 web search 工具新增 return_token_budget 参数。
查看原文 →
数据源:https://platform.openai.com/docs/changelog
Anthropic Claude
美国 · 闭源 API · Claude
4 项更新
7 月上旬围绕治理与透明度密集发声:面向公众征集 AI 最难问题、任命伯南克进入长期利益信托,并发布 Claude 使用反思功能;6 月底发布的 Claude Sonnet 5 与 Claude Science 仍是主力看点。
向公众征集关于 AI 的最难问题 2026-07-09 公司动态
Anthropic 宣布公开向公众征集他们对 AI 最尖锐、最难回答的问题,并承诺在处理这些问题时公开展示其思考与研究过程(show our work),以提升 AI 治理透明度。
查看原文 →
伯南克加入 Anthropic 长期利益信托 2026-07-09 公司动态
前美联储主席 Ben Bernanke 获任命加入 Anthropic 的长期利益信托(Long-Term Benefit Trust)。该信托负责在公司治理中代表更广泛的公共利益,此次任命进一步强化其经济与政策专业背景。
查看原文 →
推出「使用反思」功能,帮助用户审视使用方式 2026-07-09 功能
Anthropic 上线一项新功能,帮助用户反思自己使用 Claude 的方式;同日还发布客户案例:UST 将 Claude 引入物理 AI 场景,阿尔伯塔省政府用 Claude 排查并修复政府系统的网络安全漏洞。
查看原文 →
发布 Claude Sonnet 5 与科研工作台 Claude Science 2026-06-30 新模型
Anthropic 发布 Claude Sonnet 5,官方称其在编程、智能体与专业工作场景上提供可规模化的前沿性能,与 Opus 4.8 共同构成主力阵容。同日上线 Claude Science 科研 AI 工作台,集成研究者常用工具与软件包,可产出可审计的成果产物。此外 Fable 5 于 7 月 1 日全球重新上线,并联合 Amazon、微软、Google 等提出行业越狱严重程度评分框架。
查看原文 →
数据源:https://www.anthropic.com/news
Claude Code (CLI)
美国 · 编程智能体 · CLI
1 项更新
最新版本 2.1.207,Auto 模式在多云平台默认开放(Bedrock/Vertex/Foundry),Bedrock/Vertex/Claude Platform on AWS 默认切换到 Claude Opus 4.8,并修复大量流式渲染与远程控制问题。
Claude Code 2.1.207 / 2.1.206 发布 2026-07-11 功能
Auto 模式现在无需 CLAUDE_CODE_ENABLE_AUTO_MODE 显式开启即可在 Bedrock、Vertex AI 与 Foundry 上使用(可通过 disableAutoMode 关闭)。Bedrock、Vertex 与 Claude Platform on AWS 默认模型切换为 Claude Opus 4.8。修复了长列表/表格流式渲染时终端卡顿、远程控制任务状态在网络恢复后丢失、以及插件 shell 注入等多项问题;2.1.206 还改进了 claude-opus-4-8 上的 code-review 质量、为 /cd 增加路径补全。
查看原文 →
数据源:https://raw.githubusercontent.com/anthropics/claude-code/main/CHANGELOG.md
DeepSeek 深度求索
中国 · 开源/API · 深度求索
2 项更新
官网首页主推 DeepSeek-V4 预览版,具备世界顶级推理性能、Agent 能力大幅提高,已在网页端、APP 与 API 全面上线;API 平台新增原生 Anthropic 兼容端点,旧模型名 7/24 弃用。
DeepSeek-V4 预览版发布,Agent 能力大幅提升 2026-07-12 新模型
DeepSeek 官网首页公告:DeepSeek-V4 预览版本发布,具备世界顶级推理性能,Agent 能力大幅提高,已在网页端、APP 和 API 上线。API 侧对应模型为 deepseek-v4-flash 与 deepseek-v4-pro,支持思考模式(thinking.type=enabled)与 reasoning_effort 参数控制推理深度。
查看原文 →
旧模型名 deepseek-chat / deepseek-reasoner 将于 7/24 弃用 2026-07-24 API
原有的 deepseek-chat 与 deepseek-reasoner 模型名将于 2026-07-24 15:59 UTC 弃用,为保持兼容它们分别对应 deepseek-v4-flash 的非思考模式与思考模式。DeepSeek API 现同时兼容 OpenAI 与 Anthropic 格式,新增 base_url https://api.deepseek.com/anthropic,可直接用 Anthropic SDK 或 Claude Code、Copilot、OpenCode 等工具接入,无需改代码。
查看原文 →
数据源:https://www.deepseek.com/
智谱 GLM
中国 · 开源/MaaS · 智谱 Z.ai
2 项更新
开源发布新一代旗舰 GLM-5.2,在 Artificial Analysis 综合榜单取得 51 分、与 Anthropic/OpenAI 一同位居前三并为开源模型 SOTA;同时推出 GLM-5V-Turbo 多模态与 GLM-5-Turbo Agent 基座。
GLM-5.2 开源发布,登顶开源 SOTA 2026-07-11 新模型
智谱上线并开源新一代旗舰模型 GLM-5.2,在 Artificial Analysis 综合榜单取得 51 分,与 Anthropic、OpenAI 一同位居前三,为开源模型 SOTA。GLM-5.2 的 Coding 能力开源 SOTA,支持 1M 无损上下文,长程任务执行更稳定、工程规范遵循更可靠。
查看原文 →
GLM-5V-Turbo 多模态与 GLM-5-Turbo Agent 基座 2026-07-11 新模型
GLM-5V-Turbo 是原生融合视觉与文本的多模态 Coding 模型,针对视觉编程与 Agent 任务专项优化;GLM-5-Turbo 则从训练层深度优化 Agent 核心能力,大幅提升工具调用与长链路执行能力。配套的 AutoGLM 智能体具备自主规划、推理与执行及持续自我改进能力。
查看原文 →
数据源:https://www.zhipuai.cn/news
通义 Qwen
中国 · 开源 · 阿里巴巴
1 项更新
官方博客已迁移至 qwen.ai;近期开源看点为 Qwen 家族首款安全护栏模型 Qwen3Guard,主打实时逐词流式安全检测,覆盖 119 种语言。
发布安全护栏模型 Qwen3Guard 2026-07-11 安全
Qwen3Guard 是基于 Qwen3 架构、专为安全防护微调的护栏模型,可对用户输入提示与模型输出进行细粒度风险分级与分类,支持 119 种语言。提供 Qwen3Guard-Gen(生成式,用于离线安全标注与 RL 奖励信号)与 Qwen3Guard-Stream(流式,首次实现生成过程中的实时逐词安全检测)两大版本,均含 0.6B、4B、8B 三种参数规模,已上线 Hugging Face 与 ModelScope。
查看原文 →
数据源:https://qwen.ai/blog
Kimi 月之暗面
中国 · 闭源/API · Moonshot AI
2 项更新
开放平台首页公告 Kimi K2.7 Code 正式发布,为 Kimi 当前最强 Coding 模型,高速版 kimi-k2.7-code-highspeed 同步上线;上一代 K2.6 转为通用多模态主力。
Kimi K2.7 Code 正式发布,当前最强编程模型 2026-07-12 新模型
月之暗面在 Kimi 开放平台发布 Kimi K2.7 Code,官方称其为 Kimi 当前最强 Coding 模型,支持 256K 上下文窗口、文本/图片/视频输入与思考模式,适合编程 Agent、长程代码任务与软件工程场景;高速版 kimi-k2.7-code-highspeed 同步上线以兼顾速度。API 兼容 OpenAI 格式,可通过 Codex、Claude Code、Cline、RooCode、OpenCode 等工具接入。
查看原文 →
Kimi K2.6 转为通用多模态主力 2026-06-20 新模型
Kimi K2.6 综合能力强,支持 256K 上下文窗口、文本/图片/视频输入以及思考与非思考模式切换,适合通用对话、Agent 任务、视觉理解与复杂推理场景,与 K2.7 Code 形成「编程 + 通用」双主力配置。
查看原文 →
数据源:https://platform.moonshot.cn/docs/api/changelog
豆包 / 字节 Seed
中国 · 闭源 · 字节跳动 Seed
3 项更新
近期以视觉生成与研究成果为主:Seedream 5.0 Pro 图像模型发布、EdgeBench 环境学习基准,及 Seed2.1 生产力模型发布。
Seedream 5.0 Pro 图像模型发布 2026-07-08 新模型
字节 Seed 团队发布图像生成模型 Seedream 5.0 Pro,主题为「不止生成,更懂设计」,强调在设计感与实际可用性上的提升,面向海报、创意设计等专业视觉生产场景。
查看原文 →
EdgeBench:真实世界环境学习基准 2026-07-07 研究
Seed 团队推出 EdgeBench,用于衡量模型在真实世界环境中的学习能力,并从中发现新的 Scaling Law(扩展规律),为环境学习方向的研究提供评测标尺。
查看原文 →
Seed2.1 正式发布 2026-06-23 新模型
Seed2.1 正式发布,主题为「深入 AI 生产力」,面向生产力场景强化模型能力。同期 Seed 团队还有 Seed3D 2.0、Seed 全双工语音大模型等成果。
查看原文 →
数据源:https://team.doubao.com/zh/blog
文心一言 / 百度
中国 · 闭源 · 百度千帆
本期无新增
本次抓取仅返回百度智能云千帆平台文档导航框架,未能提取到具体的文心/千帆更新公告条目,故本期留空以避免臆测。
百度千帆文档主页与 yiyan.baidu.com 均为 JS 动态渲染,curl 仅取到智能云控制台与千帆平台的导航结构,未能解析出近 30 天的具体更新公告;为遵循「宁缺勿假」原则,本期不臆造版本号与参数,updates 留空。
数据源:https://cloud.baidu.com/doc/WENXINWORKSHOP/index.html
⚠️ 说明
本报告由 Baby Q 自动抓取整理,内容仅供参考。新模型/API/价格变更以厂商官方公告为准。报告每日 10:00(北京时间)自动更新。