报告生成时间 · 2026-07-07 10:12:34 (Asia/Shanghai)
报告日期
2026-07-07
覆盖厂商
9
新增更新
29
生成时间
2026-07-07 10:12:34 (Asia/Shanghai)
快速跳转
OpenAI · 5 Anthropic Claude · 5 Claude Code (CLI) · 3 DeepSeek 深度求索 · 2 智谱 GLM · 3 通义 Qwen · 3 Kimi 月之暗面 · 2 豆包 / 字节 Seed · 3 文心一言 / 百度 · 3
OpenAI
美国 · 闭源 API · ChatGPT
5 项更新
近一个月 OpenAI 以实时语音与平台工具更新为主:7 月 6 日发布 GPT-Realtime-2.1 系列,6 月密集上线安全用量看板、Web 搜索返回图片、审核分数等能力。当前生产旗舰仍为 4 月发布、支持 100 万上下文的 GPT-5.5。
发布 GPT-Realtime-2.1 及 mini 版实时语音模型 2026-07-06 新模型
OpenAI 上线 GPT-Realtime-2.1,这是一款升级的实时推理语音模型,改进了字母数字识别、静音与噪声处理以及打断(interruption)行为。同时发布 GPT-Realtime-2.1-mini,一款更快、更低成本的蒸馏推理模型,面向实时语音应用。接口走 v1/realtime。
查看原文 →
上线 Safety Usage 安全用量看板 2026-06-23 功能
在 OpenAI API 平台推出安全用量看板(Safety Usage Dashboard),基于请求中携带的 safety_identifier 值展示被安全策略拦截的 Responses 请求,帮助开发者按终端用户维度排查安全拦截情况。
查看原文 →
Web 搜索工具支持返回图片结果 2026-06-09 功能
Responses API(v1/responses)的 Web 搜索工具现在可在常规文本结果之外同时返回图片结果,适用于需要联网实时视觉素材的场景,如商品图、地标、地点、活动或视觉参考。
查看原文 →
Responses 与 Chat Completions 新增审核分数 2026-06-04 安全
为 Responses API 与 Chat Completions API 增加审核(moderation)分数,只需在生成请求中传入 moderation 对象,即可在同一响应里同时得到模型输入与生成输出的审核结果,底层为 omni-moderation-latest。
查看原文 →
内置工具容器会话改为按分钟计费 2026-06-02 价格
自 2026 年 6 月 2 日起,符合条件的容器会话由按整段 20 分钟会话计费改为按分钟计费(最低 5 分钟起),底层每分钟费率不变。此举让短会话计费更细粒度,可降低短任务的实际成本。
查看原文 →
数据源:https://platform.openai.com/docs/changelog
Anthropic Claude
美国 · 闭源 API · Claude
5 项更新
Anthropic 近一个月动作密集:6 月 30 日发布新一代 Claude Sonnet 5,同期重新全球部署 Fable 5 并联合亚马逊、微软、谷歌提出越狱严重度评分框架;另推出面向科研的 Claude Science、团队协作的 Claude Tag,并在首尔设立办公室。
发布 Claude Sonnet 5 2026-06-30 新模型
Anthropic 推出新一代 Claude Sonnet 5,宣称在编程、Agent 智能体与专业工作场景实现规模化的前沿性能表现。该模型定位为兼顾能力与成本的主力型号,官方文档已同步 What's new in Claude Sonnet 5 说明页;配合其上的旗舰 Claude Opus 4.8 构成最新模型阵容。
查看原文 →
重新部署 Fable 5 并提出行业越狱评分框架 2026-06-30 安全
Fable 5 于 7 月 1 日恢复全球可用。Anthropic 联合亚马逊、微软、谷歌等 Glasswing 合作伙伴,提出一套行业通用的越狱(jailbreak)严重程度评分框架,7 月 2 日进一步披露了 Fable 5 的网络安全防护措施与该框架的更多细节。
查看原文 →
推出面向科学家的 Claude Science 工作台 2026-06-30 功能
Claude Science 是一款可定制的 AI 科研应用,集成了研究人员最常用的工具与软件包,能够产出可审计(auditable)的工件,并提供对计算资源的灵活访问,面向科研全流程提效。
查看原文 →
推出团队协作新形态 Claude Tag 2026-06-23 功能
Anthropic 发布 Claude Tag,作为团队与 Claude 协作的一种全新方式,面向多人/团队工作流场景,降低协同使用门槛。
查看原文 →
开设首尔办公室,深化韩国 AI 生态合作 2026-06-17 公司动态
Anthropic 宣布在首尔设立办公室,并公布与韩国 AI 生态的多项新合作伙伴关系,加速其在亚太地区的商业与生态布局。同期还与 TCS 达成合作,将 Claude 引入受监管行业。
查看原文 →
数据源:https://www.anthropic.com/news
Claude Code (CLI)
美国 · 命令行编程 Agent
3 项更新
Claude Code 保持高频迭代,近期版本推进到 2.1.202。重点围绕动态工作流(workflow)编排、后台 Agent 稳定性与权限模型调整:默认权限模式改为 Manual,并已适配 Claude Sonnet 5 会话。
v2.1.202:动态工作流规模设置与遥测增强 功能
在 /config 中新增 Dynamic workflow size 设置,用于控制 Claude 生成动态工作流的规模(小/中/大 Agent 数量),作为建议性指引而非硬性上限;工作流派生的 Agent 遥测新增 workflow.run_id 与 workflow.name 两个 OpenTelemetry 属性。同时 /review 恢复为快速单轮评审,多 Agent 评审改用 /code-review。
查看原文 →
v2.1.201:适配 Claude Sonnet 5 会话 功能
Claude Sonnet 5 会话不再使用对话中途的 system 角色来发送 harness 提醒,行为更贴合新模型,减少上下文干扰。
查看原文 →
v2.1.200:默认权限模式改为 Manual 功能
AskUserQuestion 对话框默认不再自动继续,可在 /config 中选择开启空闲超时;同时将 CLI、--help、VS Code 与 JetBrains 中的默认权限模式从 default 改为 Manual(manual),提升人工确认的安全性。
查看原文 →
数据源:https://raw.githubusercontent.com/anthropics/claude-code/main/CHANGELOG.md
DeepSeek 深度求索
中国 · 开源/API · 杭州
2 项更新
DeepSeek 官网首页已挂出 DeepSeek-V4 预览版,主打世界顶级推理与大幅提升的 Agent 能力,网页/APP/API 三端上线。需注意:API 变更日志中最近一条正式记录为 4 月 24 日的 V4,且旧模型名将于 2026-07-24 停用。近 30 天无全新增补公告。
DeepSeek-V4 上线(V4-Pro / V4-Flash) 2026-04-24 新模型
DeepSeek API 支持 V4-Pro 与 V4-Flash 两款模型,可通过 OpenAI ChatCompletions 接口与 Anthropic 接口调用,base_url 不变,model 参数设为 deepseek-v4-pro 或 deepseek-v4-flash。官网首页同步展示 DeepSeek-V4 预览版,强调世界顶级推理性能与显著增强的 Agent 能力。
查看原文 →
旧模型名 deepseek-chat / deepseek-reasoner 即将停用 2026-07-24 API
两个旧 API 模型名 deepseek-chat 与 deepseek-reasoner 将于 2026-07-24 停用(这是本周内即将生效的重要变更)。过渡期内二者分别指向 deepseek-v4-flash 的非思考模式与思考模式,开发者应尽快迁移到 v4 系列显式模型名。
查看原文 →
数据源:https://api-docs.deepseek.com/updates
智谱 GLM
中国 · 开源/API · 北京(港股 02513)
3 项更新
智谱当前旗舰为 GLM-5.2,已上线并开源,在 Artificial Analysis 综合榜单取得 51 分、与 Anthropic、OpenAI 同列前三,为开源模型 SOTA;配套推出多模态 GLM-5V-Turbo、Agent 基座 GLM-5-Turbo。公司层面已在港交所上市(代码 02513)。
GLM-5.2 上线并开源,跻身全球综合榜前三 新模型
GLM-5.2 是智谱上线并开源的新一代旗舰模型,在 Artificial Analysis 综合榜单取得 51 分,与 Anthropic、OpenAI 一起位居前三,为开源模型 SOTA。其 Coding 能力为开源 SOTA,支持 100 万(1M)无损上下文,长程任务执行更稳定、工程规范遵循更可靠。
查看原文 →
发布多模态 GLM-5V-Turbo 与 Agent 基座 GLM-5-Turbo 新模型
GLM-5V-Turbo 是原生融合视觉与文本能力的多模态 Coding 模型,针对视觉编程与 Agent 任务专项优化;GLM-5-Turbo 则是专为 Agent 场景打造的基座模型,从训练层深度优化工具调用与长链路执行能力。二者面向智能体应用落地。
查看原文 →
智谱港股上市,发布首份业绩报告 公司动态
智谱(香港联交所股票代码 02513)已完成上市,并发布首份业绩报告,探索 AGI 智能上界。公司同时在推进 AutoGLM、AutoClaw 等自主智能体产品的商业化落地。
查看原文 →
数据源:https://www.zhipuai.cn/news
通义 Qwen
中国 · 开源/API · 阿里云
3 项更新
阿里通义近期升级到 Qwen3.7 系列,旗舰 Qwen3.7-Max 已上线(推理后付费即日起至 7 月 23 日限时 5 折),面向智能体时代;同时推出实时同传 Qwen3.5-LiveTranslate、Wan2.7 视频生成系列,并在 HuggingFace 密集开源 Qwen-AgentWorld-35B、Qwen3-ASR 等模型。
Qwen3.7-Max / Qwen3.7-Plus 上线,限时 5 折 新模型
Qwen3.7 系列面向智能体时代打造,旗舰 Qwen3.7-Max 为全能智能体模型,具备编程、办公自动化、长周期任务自主执行等能力,支持 Token Plan 抵扣;Qwen3.7-Plus 为多模态智能体模型,既能看懂界面、操作应用,也能写代码交付结果。即日起至 7 月 23 日,推理后付费享限时 5 折。
查看原文 →
Qwen3.5-LiveTranslate 实时同传上线 新模型
Qwen3.5-LiveTranslate 是基于 Qwen3.5-Omni 基座的多语言实时音视频同传模型,覆盖 60 种语言、可说 29 种语言,端到端延迟低至 2.5 秒,并支持实时克隆原声,让跨语言交流更自然。
查看原文 →
HuggingFace 密集开源:Qwen-AgentWorld-35B、Qwen3-ASR 等 开源
通义近两周在 HuggingFace 持续开源:Qwen-AgentWorld-35B-A3B(面向通用 Agent 的语言世界模型,35B、约 12 天前更新,下载 5.78 万),以及 Qwen3-ASR-0.6B/1.7B 语音识别、Qwen3-ForcedAligner 等(约 11 天前更新);Wan2.7 文生视频/参考生视频与 Wan2.7-Image 图像统一模型亦同步上线。
查看原文 →
数据源:https://qwen.ai/blog
Kimi 月之暗面
中国 · API · 北京 Moonshot AI
2 项更新
月之暗面正式发布 Kimi 当前最强 Coding 模型 K2.7 Code,高速版同步上线,主打编程 Agent 场景;通用旗舰 K2.6 为原生多模态模型。两款模型均支持 256K 上下文与文本/图片/视频输入。
Kimi K2.7 Code 正式发布,主打编程 Agent 新模型
Kimi K2.7 Code 是 Kimi 当前最强 Coding 模型,高速版 kimi-k2.7-code-highspeed 同步上线;支持 256K 上下文窗口、文本/图片/视频输入与思考模式,专为 Claude Code、Cline、Roo Code 等编程 Agent 及长程代码任务、软件工程场景优化。API 兼容 OpenAI 格式。
查看原文 →
Kimi K2.6 原生多模态旗舰 2026-04-20 新模型
Kimi K2.6 综合能力强,具备原生多模态理解、超强代码能力与 Agent 性能;支持 256K 上下文窗口、文本/图片/视频输入以及思考与非思考两种模式,适合通用对话、Agent 任务、视觉理解与复杂推理。
查看原文 →
数据源:https://platform.moonshot.cn/docs/api/changelog
豆包 / 字节 Seed
中国 · API · 字节跳动 / 火山方舟
3 项更新
字节 Seed 团队 6 月 23 日正式发布 Seed2.1,主打深入 AI 生产力,已作为火山方舟最新模型上线;配套的 Seedance 2.0(视频)、Seedream 5.0 Lite(图像)、Seeduplex(全双工语音)构成完整多模态矩阵。
Seed2.1 正式发布,深入 AI 生产力 2026-06-23 新模型
字节跳动 Seed 团队正式发布 Seed2.1,主题为深入 AI 生产力,已作为火山方舟平台的最新模型上线,可通过方舟 API 调用(支持深度思考、上下文缓存、Responses API 等能力)。这是继 2 月 Seed2.0 之后的又一次旗舰迭代。
查看原文 →
Seed3D 2.0 发布,精度与可用性提升 2026-04-23 新模型
Seed3D 2.0 发布,主打更高精度与更强可用性,面向 3D 生成场景。结合 Seedance 2.0 视频生成、Seedream 5.0 Lite 图像生成,字节 Seed 的多模态生成能力持续扩展。
查看原文 →
Seed 全双工语音大模型发布 2026-04-09 新模型
Seed 全双工语音大模型(Seeduplex 方向)发布,主打懂倾听、抗干扰,走向更自然的人机语音交互体验,可用于实时语音对话与助手类场景。
查看原文 →
数据源:https://team.doubao.com/zh/blog
文心一言 / 百度
中国 · 开源/API · 百度智能云千帆
3 项更新
百度近 30 天更新集中在 AI 平台侧:7 月 6 日多模态 OCR 大模型 Unlimited-OCR 上线并登顶 HuggingFace 多模态榜,6 月端到端语音大模型 Pro 版商用、PaddleOCR-VL 1.6 升级。核心 文心/ERNIE 4.5 大模型家族(最大 424B、128K 上下文)已按 Apache 2.0 开源。
Unlimited-OCR 企业级多模态服务上线 2026-07-06 新模型
百度上线 Unlimited-OCR 企业级服务,GitHub Star 五天破万,位列 HuggingFace 全球多模态大模型榜单第一,最高可享 1000 页免费测试资源。这是百度在文档解析/多模态理解方向的最新旗舰能力。
查看原文 →
端到端语音语言大模型 Pro 版商用开售 2026-06-17 价格
百度端到端语音语言大模型 Pro 版正式商用开售,新用户最高可享 100 万免费 tokens。该模型主打开口即真人的自然语音交互,面向语音助手与实时对话场景。
查看原文 →
PaddleOCR-VL 1.6 文档解析能力升级 2026-06-12 功能
文档解析模型 PaddleOCR-VL 1.6 发布,文本、表格、公式解析能力全面增强。配合已开源的 ERNIE 4.5 家族(含 300B-A47B、21B-A3B、VL-424B-A47B、VL-28B-A3B 及 0.3B,128K 上下文、Apache 2.0 协议),构成百度全栈模型底座。
查看原文 →
数据源:https://cloud.baidu.com/doc/WENXINWORKSHOP/index.html
⚠️ 说明
本报告由 Baby Q 自动抓取整理,内容仅供参考。新模型/API/价格变更以厂商官方公告为准。报告每日 10:00(北京时间)自动更新。