报告生成时间 · 2026-07-09 10:10:00 (Asia/Shanghai)
报告日期
2026-07-09
覆盖厂商
9
新增更新
25
生成时间
2026-07-09 10:10:00 (Asia/Shanghai)
快速跳转
OpenAI · 3 Anthropic Claude · 4 Claude Code (CLI) · 2 DeepSeek 深度求索 · 2 智谱 GLM · 3 通义 Qwen · 3 Kimi 月之暗面 · 2 豆包 / 字节 Seed · 3 文心一言 / 百度 · 3
OpenAI
美国 · 闭源 API · ChatGPT
3 项更新
当前旗舰生产模型仍为 GPT-5.5,7 月主打实时语音模型迭代(gpt-realtime-2.1);6 月启动平台精简,逐步下线 Agent Builder、Evals 平台与可复用 prompt 对象,本周官方 changelog 无新增条目。
发布 gpt-realtime-2.1 及 mini 版实时语音模型 2026-07-06 新模型
OpenAI 上线 gpt-realtime-2.1 实时推理语音模型,在字母数字识别、静音与噪声处理、打断行为等方面显著改进。同时发布 gpt-realtime-2.1-mini,一款蒸馏得到的更快、更低成本推理模型,面向实时语音应用场景,均通过 v1/realtime 端点提供。这是官方 changelog 目前最新一条,7 月至今无更新。
查看原文 →
更新 chat-latest 快照,指向 ChatGPT 当前 Instant 模型 2026-06-24 API
OpenAI 更新了 chat-latest 快照,该快照指向 ChatGPT 当前使用的 Instant 模型,底层模型会定期滚动更新。官方仍建议生产环境统一使用 GPT-5.5,chat-latest 主要用于测试面向 chat 场景的最新改进。
查看原文 →
宣布下线 Agent Builder、Evals 平台与可复用 Prompt 对象 2026-06-03 API
OpenAI 发布平台精简公告,宣布逐步停用可复用 prompt 对象、Evals 评测平台与 Agent Builder,具体迁移时间线见官方 deprecations 页面。配套调整包括自 6 月 2 日起容器会话由整段 20 分钟计费改为按分钟计费(最低 5 分钟起,单价不变),可显著降低短时任务成本。
查看原文 →
数据源:https://platform.openai.com/docs/changelog
Anthropic Claude
美国 · 闭源 API · Claude
4 项更新
7 月 1 日恢复 Claude Fable 5 与 Mythos 5 的访问(6 月 12 日曾因美国政府指令暂停);6 月 30 日发布新一代 Claude Sonnet 5(1M 上下文)与面向科研的 Claude Science;持续清退旧模型与 fast 模式。
恢复 Claude Fable 5 与 Mythos 5 访问 2026-07-01 公司动态
Anthropic 宣布已恢复 Claude Fable 5(claude-fable-5)与 Claude Mythos 5(claude-mythos-5)的访问,此前于 6 月 12 日因美国政府一项指令被要求暂停访问。两款模型默认支持 1M token 上下文窗口、128k 最大输出与始终开启的自适应思考,Fable 5 为目前最强的广泛发布模型。同期 Anthropic 联合亚马逊、微软、谷歌等 Glasswing 伙伴提出行业级越狱严重性评分框架。
查看原文 →
发布 Claude Sonnet 5:1M 上下文、限时降价 2026-06-30 新模型
Anthropic 推出新一代 claude-sonnet-5,限时优惠价 2 / 10 美元每百万 tokens(截至 2026-08-31,之后恢复标准价 3 / 15 美元)。支持 1M token 上下文窗口、128k 最大输出,工具与平台功能与 Sonnet 4.6 对齐(不含 Priority Tier)。默认开启自适应思考、移除手动 extended thinking,并采用新分词器,同样文本约多产生 30% tokens。
查看原文 →
面向科研的 Claude Science 工作台上线,会话流支持 event deltas 2026-06-30 功能
Claude Science 是一款可定制的 AI 科研工作台,集成研究人员常用工具与软件包,能产出可审计的分析产物并提供灵活算力接入。同日 Claude Managed Agents 的会话事件流新增 event deltas(通过 event_deltas 查询参数开启),可在完整 agent.message 到达前逐步预览生成中的文本。
查看原文 →
全面上调 API 速率上限并合并用量层级 2026-06-26 API
Anthropic 提升了 Claude API 各档速率上限,Sonnet 与 Haiku 的速率限制现已对齐 Opus,用量层级精简合并为 Start、Build、Scale 三档。多数组织将自动升档、无组织被下调、用户无需操作。同期还清退了 Claude Sonnet 4 / Opus 4 旧模型,并陆续移除 Opus 4.6/4.7 的 fast 模式(建议迁移至 Opus 4.8)。
查看原文 →
数据源:https://docs.claude.com/en/release-notes/overview
Claude Code (CLI)
美国 · 编程 Agent · 命令行工具
2 项更新
版本迭代极快,最新已到 2.1.205(较昨日 2.1.204 再进一版)。本期主打会话安全加固(禁止篡改会话 transcript)、修复 --json-schema 无效时静默降级、Windows worktree 误删外部文件等问题,并将 /doctor 升级为完整体检。
更新至 2.1.205,加固会话安全与结构化输出 2026-07 功能
2.1.205 新增 auto mode 规则阻止篡改会话 transcript 文件;修复 --json-schema 在 schema 无效时静默产出非结构化输出、以及使用 format 关键字的 schema 被拒绝的问题;修复 Windows 上删除 worktree 时误删 NTFS junction/符号链接指向的外部文件。/doctor 升级为可诊断并修复问题的完整体检(/checkup 为其别名),并预留 Claude Browser MCP 服务名。
查看原文 →
2.1.203–2.1.204 密集修复后台 Agent 稳定性 2026-07 功能
近期版本大量修复后台 Agent 问题:守护进程 session token 失效导致会话永久无响应(现可自动恢复)、后台 Agent 继承过期 PATH、丢失 ANTHROPIC_BASE_URL 导致 401、工作目录被删后崩溃重启等。自动更新的二进制下载改为流式写盘而非全部驻留内存,峰值内存降低约 400 MB;并新增登录即将过期提醒与手动权限模式灰色暂停徽标。
查看原文 →
数据源:https://raw.githubusercontent.com/anthropics/claude-code/main/CHANGELOG.md
DeepSeek 深度求索
中国 · 开源/开放 API · 杭州深度求索
2 项更新
DeepSeek-V4 预览版发布,具备世界顶级推理与大幅增强的 Agent 能力,已在网页端、APP 与 API 全面上线;V4-Pro / V4-Flash 通过 API 提供,旧模型名将于 7 月 24 日停用。
DeepSeek-V4 预览版发布,全端上线 2026-07 新模型
官网首页公告 DeepSeek-V4 预览版本发布,宣称具备世界顶级推理性能、Agent 能力大幅提高,已在网页端、APP 和 API 上线。这是继 V3.2 系列之后的新一代旗舰,主打推理与智能体任务能力,用户可在网页端免费对话体验。
查看原文 →
API 支持 deepseek-v4-pro 与 deepseek-v4-flash 2026-04-24 API
DeepSeek API 现支持 V4-Pro 与 V4-Flash 两款模型,可通过 OpenAI ChatCompletions 接口与 Anthropic 接口调用,base_url 保持不变,model 参数设为 deepseek-v4-pro 或 deepseek-v4-flash 即可。旧模型名 deepseek-chat 与 deepseek-reasoner 将于 2026-07-24 起停用,过渡期内分别指向 deepseek-v4-flash 的非思考与思考模式。
查看原文 →
数据源:https://www.deepseek.com/
智谱 GLM
中国 · 开源/开放 API · 智谱 AI
3 项更新
新一代旗舰 GLM-5.2 上线并开源,综合榜 51 分与 Anthropic、OpenAI 并列前三、Coding 开源 SOTA、支持 1M 无损上下文;同期推出多模态编程模型 GLM-5V-Turbo、Agent 基座 GLM-5-Turbo 与智能体模型 AutoGLM。
GLM-5.2 上线并开源,跻身综合榜前三 2026-07 新模型
GLM-5.2 是智谱上线并开源的新一代旗舰模型,在 Artificial Analysis 综合榜单取得 51 分,与 Anthropic、OpenAI 一起位居前三,为开源模型 SOTA。Coding 能力为开源 SOTA,支持 1M 无损上下文,长程任务执行更稳定、工程规范遵循更可靠,注册即可领取 2000 万 tokens 免费额度。
查看原文 →
推出多模态编程模型 GLM-5V-Turbo 与 Agent 基座 GLM-5-Turbo 2026-07 新模型
GLM-5V-Turbo 是原生融合视觉与文本的多模态 Coding 模型,针对视觉编程与 Agent 类任务专项优化;GLM-5-Turbo 则从训练层深度优化 Agent 核心能力,大幅提升工具调用与长链路执行能力。配套智能体模型 AutoGLM 具备自主规划、推理与执行及持续自我改进能力。
查看原文 →
智谱发布首份业绩报告 2026-07 公司动态
智谱(香港联交所股票代码 02513)发布首份业绩报告,对外披露经营情况并阐述其在通用人工智能(AGI)方向上探索智能上界的进展,标志公司在商业化与技术路线上进入新阶段。
查看原文 →
数据源:https://www.zhipuai.cn/news
通义 Qwen
中国 · 开源/开放 API · 阿里巴巴
3 项更新
面向智能体时代的 Qwen3.7 系列重磅发布,Qwen3.7-Max 已上线并限时 5 折;多语言实时同传模型 Qwen3.5-LiveTranslate 上线;百炼平台同步刷新万相 Wan2.7 视频/图像生成矩阵。
Qwen3.7 系列发布,Max 版限时 5 折 2026-07 新模型
Qwen3.7 是阿里面向智能体时代打造的新一代旗舰系列,在编程、办公自动化与长周期任务自主执行能力上全面进阶。Qwen3.7-Max 为全能智能体模型、支持 Token Plan 抵扣,已上线并即日起至 7 月 23 日享受推理后付费限时 5 折;Qwen3.7-Plus 为多模态智能体模型,能看懂界面、操作应用,也能写代码交付结果,实现看想写做验端到端闭环。
查看原文 →
上线万相 Wan2.7 视频与图像生成矩阵 2026-07 新模型
百炼平台刷新万相 Wan2.7 系列:Wan2.7-T2V 文生视频支持电影美学控制与细腻文戏演绎,Wan2.7-R2V 参考生视频支持图/视频混合参考与音色参考,Wan2.7-Image 为图像生成与编辑统一模型(支持千人千面定制与精准框选编辑)。配套还有图片编辑模型 Qwen-Image-2.0-Pro,主打专业文字渲染与更强语义遵循。
查看原文 →
多语言实时同传模型 Qwen3.5-LiveTranslate 2026-07 新模型
Qwen3.5-LiveTranslate 是基于 Qwen3.5-Omni 基座的多语言实时音视频同传模型,覆盖 60 种语言、约 2.5 秒低延迟同传,并支持实时克隆原声,面向跨语言实时会议、直播等场景。家族还包括全模态 Qwen3.5-Omni-Flash、语音合成 Qwen3-TTS-Flash(17 种拟人音色)等模型。
查看原文 →
数据源:https://help.aliyun.com/zh/model-studio/
Kimi 月之暗面
中国 · 开放 API · 月之暗面 Moonshot
2 项更新
Kimi K2.7 Code 正式发布,为当前最强 Coding 模型,高速版 kimi-k2.7-code-highspeed 同步上线;旗舰多模态模型 Kimi K2.6 支持 256K 上下文与文本/图片/视频输入。
Kimi K2.7 Code 正式发布,主打编程 Agent 2026-07 新模型
Kimi K2.7 Code 是月之暗面当前最强 Coding 模型,高速版 kimi-k2.7-code-highspeed 已同步上线,适合 Codex、Claude Code、Cline、RooCode、OpenCode 等编程 Agent 场景。支持 256K 上下文窗口、文本/图片/视频输入与思考模式,面向长程代码任务与软件工程优化,API 兼容 OpenAI 格式。
查看原文 →
旗舰多模态模型 Kimi K2.6 2026-04-20 新模型
Kimi K2.6 为面向通用场景的多模态基座模型,赋能深度研究、一键建站、智能制表及 PPT 自主编辑等 Agent 能力。近期月之暗面还相继推出 Agent Swarm(Agent 集群)与 WorldVQA 等研究成果,持续强化多模态与智能体方向。
查看原文 →
数据源:https://platform.moonshot.cn/docs/
豆包 / 字节 Seed
中国 · 闭源 API · 字节跳动 Seed
3 项更新
字节 Seed 团队近日连发多弹:7 月 8 日发布图像模型 Seedream 5.0 Pro(不止生成、更懂设计),7 月 7 日推出 EdgeBench 基准衡量真实世界环境学习并发现新 Scaling Law;旗舰语言模型 Seed2.1 深入 AI 生产力。
Seedream 5.0 Pro 发布:不止「生成」,更懂「设计」 2026-07-08 新模型
字节 Seed 团队发布新一代图像生成模型 Seedream 5.0 Pro,主打从「生成」走向「设计」,在版式设计、文字排布与美学表现上进一步增强,是 Seedream 系列的专业升级版本,面向海报、营销物料等专业视觉创作场景。
查看原文 →
发布 EdgeBench 基准,发现新 Scaling Law 2026-07-07 研究
Seed 团队推出 EdgeBench,用于衡量模型在真实世界环境中的学习能力(environment learning),并据此发现一条新的 Scaling Law。该研究面向智能体在真实交互环境中持续学习与适应的评测空白,为后续模型能力扩展提供了新的度量维度。
查看原文 →
Seed2.1 正式发布,深入 AI 生产力 2026-06-23 新模型
字节跳动 Seed 团队正式发布 Seed2.1,主打深入 AI 生产力场景,在编程、办公与复杂任务处理上进一步增强,是火山引擎平台当前的最新旗舰语言模型(模型接入点 Seed 2.1)。配合此前的 Seed3D 2.0 三维生成(2026-04-23)与全双工语音大模型,构成字节 Seed 多模态产品矩阵。
查看原文 →
数据源:https://team.doubao.com/zh/blog
文心一言 / 百度
中国 · 闭源 API · 百度千帆
3 项更新
文心 5.0 原生全模态大模型上线(含 Thinking 预览版),主力矩阵扩充至 ERNIE X1.1 Preview、ERNIE 4.5 Turbo 系列;千帆平台以 Agent 为核心,并同步接入 DeepSeek-V4 预览版 API。
文心 5.0 原生全模态大模型上线 2026-07 新模型
文心 5.0(ernie-5.0)是原生全模态大模型,基础能力全面升级,具备更强深度思考与视觉理解能力,在多模态理解、指令遵循、创意写作、事实性、智能体规划与工具应用等方面表现突出。上下文 119k/64k,输入价格约 0.006-0.01 元每千 tokens、输出约 0.024-0.04 元每千 tokens,另提供 ernie-5.0-thinking-preview 深度思考预览版。
查看原文 →
上线 ERNIE X1.1 Preview 及 4.5 Turbo 系列 2026-07 新模型
ERNIE X1.1 Preview(ernie-x1.1-preview)在问答、工具调用、智能体、指令遵循、逻辑推理、数学与代码任务上效果显著提升,支持 64K 上下文,输入 0.001 元、输出 0.004 元每千 tokens。ERNIE 4.5 Turbo VL 多模态版支持 128K 上下文,另有 ERNIE 4.5 Turbo 文本版以更快速度、更低价格提供。
查看原文 →
千帆平台接入 DeepSeek-V4 预览版 API 2026-07 API
百度智能云千帆大模型平台宣布提供 DeepSeek-V4 预览版 API 服务,进一步丰富平台第三方模型矩阵。千帆以 Agent 为核心,围绕多智能体协同 Agent、自主规划 Agent、工作流 Agent 与知识库 RAG 构建企业级智能体落地能力,全面兼容 A2A 协议。
查看原文 →
数据源:https://cloud.baidu.com/product/wenxinworkshop
⚠️ 说明
本报告由 Baby Q 自动抓取整理,内容仅供参考。新模型/API/价格变更以厂商官方公告为准。报告每日 10:00(北京时间)自动更新。