报告生成时间 · 2026-07-08 10:08:19 (Asia/Shanghai)
报告日期
2026-07-08
覆盖厂商
9
新增更新
22
生成时间
2026-07-08 10:08:19 (Asia/Shanghai)
快速跳转
OpenAI · 3 Anthropic Claude · 3 Claude Code (CLI) · 2 DeepSeek 深度求索 · 2 智谱 GLM · 3 通义 Qwen · 2 Kimi 月之暗面 · 2 豆包 / 字节 Seed · 2 文心一言 / 百度 · 3
OpenAI
美国 · 闭源 API · ChatGPT
3 项更新
当前旗舰生产模型为 GPT-5.5,7 月主打实时语音模型迭代;6 月启动一轮平台精简,宣布下线 Agent Builder、Evals 平台与可复用 prompt 对象。
发布 GPT-Realtime-2.1 及 mini 版实时语音模型 2026-07 新模型
OpenAI 上线 gpt-realtime-2.1 实时推理语音模型,在字母数字识别、静音与噪声处理、打断行为等方面显著改进。同时发布 gpt-realtime-2.1-mini,一款经过蒸馏的更快、更低成本推理模型,面向实时语音应用场景,均通过 v1/realtime 端点提供。
查看原文 →
宣布下线 Agent Builder、Evals 平台与可复用 Prompt 对象 2026-06 API
OpenAI 发布平台精简公告,宣布逐步停用可复用 prompt 对象、Evals 评测平台与 Agent Builder,具体迁移时间线见官方 deprecations 页面。官方推荐生产环境统一迁移至 GPT-5.5,并同步更新了 chat-latest 快照指向 ChatGPT 当前 Instant 模型。
查看原文 →
容器会话改为按分钟计费,上线安全用量看板 2026-06 价格
自 2026 年 6 月 2 日起,符合条件的容器会话由原先按整段 20 分钟计费改为按分钟计费(最低 5 分钟起,单价不变),可显著降低短时任务成本。同时新增 Safety Usage Dashboard,基于请求中的 safety_identifier 展示被安全策略拦截的 Responses 请求。
查看原文 →
数据源:https://platform.openai.com/docs/changelog
Anthropic Claude
美国 · 闭源 API · Claude
3 项更新
6 月 30 日发布新一代 Claude Sonnet 5(1M 上下文),同步推出面向科研的 Claude Science 与团队协作的 Claude Tag;持续清退旧模型与 fast 模式。
发布 Claude Sonnet 5:1M 上下文、限时降价 2026-06-30 新模型
Anthropic 推出新一代 claude-sonnet-5,限时优惠价 $2 / $10 每百万 tokens(截至 2026-08-31,之后恢复标准价 $3 / $15)。支持 1M token 上下文窗口、128k 最大输出。默认开启自适应思考,移除手动 extended thinking(调用将返回 400),并采用新分词器,同样文本约多产生 30% tokens。
查看原文 →
面向科研的 Claude Science 工作台上线 2026-06-30 功能
Claude Science 是一款可定制的 AI 科研工作台,集成研究人员常用的工具与软件包,能够产出可审计的分析产物,并提供灵活的算力资源接入,帮助科研团队完成从数据到结论的全流程工作。
查看原文 →
全面上调 API 速率上限并合并用量层级 2026-06-26 API
Anthropic 提升了 Claude API 各档速率上限,Sonnet 与 Haiku 的速率限制现已对齐 Opus,用量层级精简合并为 Start、Build、Scale 三档。多数组织将自动升档,无任何组织被下调,用户无需操作。同期还清退了 Claude Sonnet 4 / Opus 4 旧模型并调整了 Opus 4.6/4.7 的 fast 模式。
查看原文 →
数据源:https://docs.claude.com/en/release-notes/overview
Claude Code (CLI)
美国 · 编程 Agent · 命令行工具
2 项更新
版本迭代极快,最新为 2.1.204,本期以后台 Agent(background agents)稳定性修复为主,并优化了内存占用与启动体积。
更新至 2.1.204,密集修复后台 Agent 稳定性 2026-07 功能
近期版本(至 2.1.204)大量修复后台 Agent 相关问题:包括守护进程 session token 失效导致会话永久无响应、后台 Agent 继承过期 PATH、丢失 ANTHROPIC_BASE_URL 导致 401、工作目录被删后崩溃重启等。同时新增登录即将过期提醒与手动权限模式的灰色暂停徽标。
查看原文 →
精简二进制体积并降低启动内存 2026-07 功能
通过将一个较大的内置依赖改为懒加载而非内联打包,二进制体积减小约 7 MB、启动内存降低约 7 MB。同时优化了长响应流式渲染,实时预览更新不再重绘整屏;新增 config 中的 Dynamic workflow size 设置用于控制动态工作流规模。
查看原文 →
数据源:https://raw.githubusercontent.com/anthropics/claude-code/main/CHANGELOG.md
DeepSeek 深度求索
中国 · 开源/开放 API · 杭州深度求索
2 项更新
DeepSeek-V4 预览版发布,具备世界顶级推理与大幅增强的 Agent 能力,已在网页端、APP 与 API 全面上线;V4-Pro / V4-Flash 通过 API 提供。
DeepSeek-V4 预览版发布,全端上线 2026-07 新模型
官网首页公告 DeepSeek-V4 预览版本发布,宣称具备世界顶级推理性能,Agent 能力大幅提高,已在网页端、APP 和 API 上线。这是继 V3.2 系列之后的新一代旗舰,主打推理与智能体任务能力。
查看原文 →
API 支持 deepseek-v4-pro 与 deepseek-v4-flash 2026-04-24 API
DeepSeek API 现支持 V4-Pro 与 V4-Flash 两款模型,可通过 OpenAI ChatCompletions 接口与 Anthropic 接口调用,base_url 保持不变,model 参数设为 deepseek-v4-pro 或 deepseek-v4-flash 即可。两个旧模型名 deepseek-chat 与 deepseek-reasoner 将于 2026-07-24 起停用,过渡期内分别指向 deepseek-v4-flash 的非思考与思考模式。
查看原文 →
数据源:https://www.deepseek.com/
智谱 GLM
中国 · 开源/开放 API · 智谱 AI
3 项更新
新一代旗舰 GLM-5.2 上线并开源,Coding 能力开源 SOTA、支持 1M 无损上下文;同期推出多模态编程模型 GLM-5V-Turbo 与智能体模型 AutoGLM。
GLM-5.2 上线并开源,跻身综合榜前三 2026-07 新模型
GLM-5.2 是智谱上线并开源的新一代旗舰模型,在 Artificial Analysis 综合榜单取得 51 分,与 Anthropic、OpenAI 一起位居前三,为开源模型 SOTA。Coding 能力为开源 SOTA,支持 1M 无损上下文,长程任务执行更稳定,工程规范遵循更可靠。
查看原文 →
推出多模态编程模型 GLM-5V-Turbo 与 GLM-5-Turbo 2026-07 新模型
GLM-5V-Turbo 是原生融合视觉与文本的多模态 Coding 模型,针对视觉编程与 Agent 类任务专项优化;GLM-5-Turbo 则从训练层深度优化 Agent 核心能力,大幅提升工具调用与长链路执行能力。配套智能体模型 AutoGLM 具备自主规划、推理与执行及持续自我改进能力。
查看原文 →
智谱发布首份业绩报告 2026-07 公司动态
智谱发布首份业绩报告,对外披露经营情况并阐述其在通用人工智能(AGI)方向上探索智能上界的进展,标志公司在商业化与技术路线上进入新阶段。
查看原文 →
数据源:https://www.zhipuai.cn/news
通义 Qwen
中国 · 开源/开放 API · 阿里巴巴
2 项更新
面向智能体时代的 Qwen3.7 系列重磅发布,Qwen3.7-Max 已上线并限时 5 折;同步推出多语言实时同传模型 Qwen3.5-LiveTranslate。
Qwen3.7 系列发布,Max 版限时 5 折 2026-07 新模型
Qwen3.7 是阿里面向智能体时代打造的新一代旗舰系列,在编程、办公自动化与长周期任务自主执行能力上全面进阶。Qwen3.7-Max 为全能智能体模型,支持 Token Plan 抵扣,已上线并即日起至 7 月 23 日享受推理后付费限时 5 折;Qwen3.7-Plus 为多模态智能体模型,既能看懂界面、操作应用,也能写代码交付结果,支持超长上下文。
查看原文 →
上线多语言实时同传模型 Qwen3.5-LiveTranslate 2026-07 新模型
Qwen3.5-LiveTranslate 是基于 Qwen3.5-Omni 基座的多语言实时音视频同传模型,可听懂 60 种语言、会说 29 种语言,面向跨语言实时会议、直播等场景。此外家族还包括 Qwen3.5-Omni-Flash、Qwen3-TTS-Flash 等多模态与语音模型。
查看原文 →
数据源:https://help.aliyun.com/zh/model-studio/
Kimi 月之暗面
中国 · 开放 API · 月之暗面 Moonshot
2 项更新
Kimi K2.7 Code 正式发布,为当前最强 Coding 模型,高速版同步上线;旗舰多模态模型 Kimi K2.6 支持 256K 上下文与文本/图片/视频输入。
Kimi K2.7 Code 正式发布,主打编程 Agent 2026-07 新模型
Kimi K2.7 Code 是月之暗面当前最强 Coding 模型,高速版 kimi-k2.7-code-highspeed 已同步上线,适合 Claude Code、Cline、Roo Code 等编程 Agent 场景。支持 256K 上下文窗口、文本/图片/视频输入与思考模式,面向长程代码任务与软件工程优化。API 兼容 OpenAI 格式。
查看原文 →
旗舰多模态模型 Kimi K2.6 2026-04-20 新模型
Kimi K2.6 为面向通用场景的多模态基座模型,赋能深度研究、一键建站、智能制表及 PPT 自主编辑等 Agent 能力。近月月之暗面还相继推出 Agent Swarm(Agent 集群,2026-02-09)与 WorldVQA(2026-02-03)等研究成果。
查看原文 →
数据源:https://platform.moonshot.cn/docs/
豆包 / 字节 Seed
中国 · 闭源 API · 字节跳动 Seed
2 项更新
字节 Seed 团队 7 月 7 日发布 Seed2.1,深入 AI 生产力方向;6 月发布 Seed3D 2.0 三维生成模型,主力矩阵含 Seedance 2.0、Seedream 5.0 Lite 等。
Seed2.1 正式发布,深入 AI 生产力 2026-07-07 新模型
字节跳动 Seed 团队正式发布 Seed2.1,主打深入 AI 生产力场景,在编程、办公与复杂任务处理上进一步增强,是火山引擎平台当前的最新旗舰模型(模型接入点 Seed 2.1)。
查看原文 →
Seed3D 2.0 发布,精度与可用性提升 2026-06-23 新模型
Seed3D 2.0 三维生成模型发布,带来更高精度与更强可用性,面向 3D 资产生成场景。配合此前发布的 Seed 全双工语音大模型(2026-04-23,主打懂倾听、抗干扰、更自然交互)以及 Seedance 2.0 视频、Seedream 5.0 Lite 图像模型,构成字节 Seed 的多模态产品矩阵。
查看原文 →
数据源:https://team.doubao.com/zh/blog
文心一言 / 百度
中国 · 闭源 API · 百度千帆
3 项更新
文心 5.0 原生全模态大模型上线(含 Thinking 预览版),主力矩阵扩充至 ERNIE X1.1 Preview、ERNIE 4.5 Turbo 系列;千帆平台同步接入 DeepSeek-V4 预览版 API。
文心 5.0 原生全模态大模型上线 2026-07 新模型
文心 5.0(ernie-5.0)是原生全模态大模型,基础能力全面升级,具备更强的深度思考与视觉理解能力,在多模态理解、指令遵循、创意写作、事实性、智能体规划与工具应用等方面表现突出。上下文 119k/64k,输入价格约 ¥0.006-0.01 每千 tokens、输出约 ¥0.024-0.04 每千 tokens,另提供 ERNIE-5.0-Thinking-Preview 深度思考预览版。
查看原文 →
上线 ERNIE X1.1 Preview 及 4.5 Turbo 系列 2026-07 新模型
ERNIE X1.1 Preview(ernie-x1.1-preview)在问答、工具调用、智能体、指令遵循、逻辑推理、数学与代码任务上效果显著提升,支持 64K 上下文,输入 ¥0.001、输出 ¥0.004 每千 tokens。ERNIE 4.5 Turbo VL 多模态版支持 128K 上下文(输入 ¥0.003、输出 ¥0.009),ERNIE 4.5 Turbo 文本版以更快速度更低价格提供(输入 ¥0.0008、输出 ¥0.0032)。
查看原文 →
千帆平台接入 DeepSeek-V4 预览版 API 2026-07 API
百度智能云千帆大模型平台宣布提供 DeepSeek-V4 预览版 API 服务,进一步丰富平台第三方模型矩阵。千帆以 Agent 为核心,围绕 Agent 引擎、工具与 MCP、模型服务及企业级服务四大要素构建智能体落地能力底座。
查看原文 →
数据源:https://cloud.baidu.com/product/wenxinworkshop
⚠️ 说明
本报告由 Baby Q 自动抓取整理,内容仅供参考。新模型/API/价格变更以厂商官方公告为准。报告每日 10:00(北京时间)自动更新。