报告生成时间 · 2026-07-04 10:09:11 (Asia/Shanghai)
报告日期
2026-07-04
覆盖厂商
9
新增更新
32
生成时间
2026-07-04 10:09:11 (Asia/Shanghai)
快速跳转
OpenAI · 5 Anthropic Claude · 5 Claude Code (CLI) · 4 DeepSeek 深度求索 · 2 智谱 GLM · 4 通义 Qwen · 4 Kimi 月之暗面 · 2 豆包 / 字节 Seed · 3 文心一言 / 百度 · 3
OpenAI
美国 · 闭源 API · ChatGPT
5 项更新
6 月 OpenAI 围绕旗舰 GPT-5.5(100 万 token 上下文)持续打磨 API:Web 搜索返回图像结果、Responses/Chat 内置内容审核评分、上线安全用量看板,并把模型上架 Amazon Bedrock;同时公布可复用 prompt 对象、Evals 平台与 Agent Builder 的下线时间表。
chat-latest 快照更新至最新 Instant 模型 2026-06-24 模型
更新 chat-latest 快照,指向 ChatGPT 当前所用的最新 Instant 模型。官方建议生产环境仍优先选用 GPT-5.5,chat-latest 主要用于测试面向对话场景的最新改进,底层快照会持续滚动更新。
查看原文 →
安全用量看板 Safety Usage Dashboard 上线 2026-06-23 安全
在 OpenAI API 平台推出 Safety Usage Dashboard,基于请求携带的 safety_identifier 展示被安全策略拦截的 Responses 请求统计,帮助开发者定位触发拦截的终端用户与调用模式。
查看原文 →
Responses API 的 Web 搜索工具支持返回图像结果 2026-06-09 API
Responses API 的 Web 搜索工具现在可在文本结果之外返回图像结果,适用于需要实时或网络佐证视觉内容的场景,如商品图、地标、地点、活动与视觉参考等。
查看原文 →
Responses / Chat Completions 新增内容审核评分 2026-06-04 安全
在 Responses API 与 Chat Completions API 中加入内容审核评分:请求里传入 moderation 对象,即可在同一响应内同时获得模型输入与生成输出的审核结果,底层基于 omni-moderation-latest 审核模型。
查看原文 →
宣布下线可复用 prompt 对象、Evals 平台与 Agent Builder 2026-06-03 下线
OpenAI 宣布可复用 prompt 对象、Evals 平台与 Agent Builder 的弃用计划,具体停用时间表与迁移指引见 deprecations 页面。此外 6 月 1 日 GPT-5.4、GPT-5.5 等模型已通过兼容 Responses API 的端点上架 Amazon Bedrock(支持的模型与功能因 AWS 区域而异)。
查看原文 →
数据源:https://platform.openai.com/docs/changelog
Anthropic Claude
美国 · 闭源 API · Claude
5 项更新
6 月末 Anthropic 迎来重磅节点:发布新一代主力模型 Claude Sonnet 5,并推出科研工作台 Claude Science 与团队协作 Claude Tag;同时 Fable 5 在美政府 6/12 暂停令后于 7/1 全球重新上线,并联合亚马逊、微软、谷歌等提出越狱严重度评分行业框架。
补充 Fable 5 网络安全护栏与越狱评分框架细节 2026-07-02 安全
Anthropic 进一步披露 Fable 5 的网络安全防护措施,并联合亚马逊、微软、谷歌等 Glasswing 伙伴提出一套面向全行业的越狱(jailbreak)严重程度评分框架,用于统一衡量与披露高风险绕过行为。
查看原文 →
发布新一代主力模型 Claude Sonnet 5 2026-06-30 新模型
推出 Claude Sonnet 5,官方称其在编程、智能体与专业工作等场景实现前沿性能且可大规模落地。据 Claude Code 更新日志,Sonnet 5 原生支持 100 万 token 上下文窗口,并在 8 月 31 日前提供每百万 token 输入 2 美元、输出 10 美元的促销定价。
查看原文 →
Fable 5 于 7 月 1 日全球重新上线 2026-06-30 公司动态
在美国政府 6 月 12 日发出暂停 Fable 5 与 Mythos 5 访问的指令后,Anthropic 宣布 Fable 5 自 7 月 1 日起全球恢复可用,同时配套推出越狱严重度评分框架以回应监管对高能力模型的安全关切。
查看原文 →
科研工作台 Claude Science 正式可用 2026-06-30 产品
面向科研人员的 Claude Science 上线,集成研究者最常用的工具与软件包,产出可审计的分析产物,并提供灵活的算力接入,帮助科学家在同一环境内完成数据处理、推理与结果复现。
查看原文 →
推出团队协作新方式 Claude Tag 2026-06-23 产品
面向团队场景推出 Claude Tag,为团队提供一种与 Claude 协同工作、对任务进行标注与分派的新方式。同期 Anthropic 还在 6 月 17 日开设首尔办公室并宣布多项韩国 AI 生态合作。
查看原文 →
数据源:https://www.anthropic.com/news
Claude Code (CLI)
美国 · 命令行编程工具
4 项更新
Claude Code 保持高频迭代至 v2.1.201。近期核心变化:默认权限模式改为 Manual、AskUserQuestion 不再自动继续;此前 v2.1.197 已将 Claude Sonnet 5 设为默认模型,v2.1.198 起子代理默认后台运行、Claude in Chrome 全量上线。
v2.1.201 / v2.1.200:默认权限模式改为 Manual 功能/修复
v2.1.201 使 Claude Sonnet 5 会话不再在对话中途用 system 角色发送 harness 提醒。v2.1.200 将 CLI、VS Code、JetBrains 的默认权限模式由 default 改为 Manual;AskUserQuestion 对话框默认不再自动继续(可经 /config 设置空闲超时),并修复了睡眠/唤醒后后台会话静默中断等多项稳定性问题。
查看原文 →
v2.1.199:堆叠式技能调用与大量稳定性修复 功能/修复
支持堆叠式斜杠技能调用(如 /skill-a /skill-b,最多加载前 5 个技能);SSL 证书错误现快速失败并直接给出修复提示;流式响应中途遇服务端错误时保留已生成部分;非容量类 429 瞬时错误现自动退避重试,订阅用户默认重试次数上调至 300。
查看原文 →
v2.1.198:子代理默认后台运行、Claude in Chrome 全量上线 功能
子代理默认在后台运行,主代理可继续工作并在其完成时收到通知;Claude in Chrome 正式全量可用;新增后台代理通知(agent_needs_input / agent_completed)与 /dataviz 图表设计技能;后台代理完成代码工作后会自动提交、推送并开草稿 PR。
查看原文 →
v2.1.197:引入 Claude Sonnet 5 为默认模型 新模型
将 Claude Sonnet 5 设为 Claude Code 默认模型,原生 100 万 token 上下文窗口,8 月 31 日前促销定价为每百万 token 输入 2 美元、输出 10 美元,需升级到 2.1.197 及以上版本使用。
查看原文 →
数据源:https://raw.githubusercontent.com/anthropics/claude-code/main/CHANGELOG.md
DeepSeek 深度求索
中国 · 开源 / API
2 项更新
官网首页仍以 DeepSeek-V4 预览版为头条(世界顶级推理、Agent 能力大幅提高,已上线网页端/App/API)。需说明:官方更新日志最新一条为 2026-04-24(V4),本 30 天窗口内无全新发布;窗口内最相关的是 7 月 24 日旧模型名停用节点。
DeepSeek-V4 上线,提供 V4-Pro / V4-Flash 2026-04-24 新模型
官网首页头条为 DeepSeek-V4 预览版,宣称具备世界顶级推理性能、Agent 能力大幅提升,已在网页端、App 与 API 上线。API 侧提供 deepseek-v4-pro 与 deepseek-v4-flash 两款模型,兼容 OpenAI ChatCompletions 与 Anthropic 接口,base_url 保持不变、仅需改 model 参数。(官方更新日志日期为 2026-04-24,略早于本 30 天窗口,仍为当前主力,故一并纳入。)
查看原文 →
旧模型名 deepseek-chat / deepseek-reasoner 将停用 2026-07-24 API
旧接口模型名 deepseek-chat 与 deepseek-reasoner 将于 2026-07-24(北京时间前后)停止使用。过渡期内二者分别指向 deepseek-v4-flash 的非思考模式与思考模式,开发者需尽快迁移到 v4 系列新模型名,这是本 30 天窗口内 DeepSeek 最需关注的时间节点。
查看原文 →
数据源:https://api-docs.deepseek.com/zh-cn/updates
智谱 GLM
中国 · 开源 / API
4 项更新
智谱当前主力为新一代旗舰 GLM-5.2,已开源、主打编程开源 SOTA、支持 100 万无损上下文;配套多模态编程模型 GLM-5V-Turbo 与 Agent 基座 GLM-5-Turbo、AutoGLM。(官网新闻页未标注精确发布日期)
旗舰模型 GLM-5.2 上线并开源 新模型
智谱上线并开源新一代旗舰模型 GLM-5.2,在 Artificial Analysis 综合榜单取得 51 分,与 Anthropic、OpenAI 同列前三,为开源模型 SOTA。Coding 能力开源 SOTA,支持 100 万无损上下文(128K 最大输出),长程任务执行更稳定、工程规范遵循更可靠。前代 GLM-5.1 编程能力对齐 Claude Opus 4.6、可自主工作长达 8 小时。
查看原文 →
多模态编程模型 GLM-5V-Turbo 多模态
推出多模态 Coding 模型 GLM-5V-Turbo,原生融合视觉与文本能力,支持 200K 上下文与 128K 输出,针对视觉编程与 Agent 类任务专项优化,前端代码复刻效果更稳定。
查看原文 →
Agent 基座 GLM-5-Turbo 与 AutoGLM 功能
GLM-5-Turbo 为 Agent 场景打造的基座模型,从训练层深度优化工具调用与长链路执行能力;AutoGLM 具备自主规划、推理与执行能力,可持续自我改进,并配套 AutoGLM-Phone 手机智能助理框架。
查看原文 →
公司动态:港股上市,注册赠 2000 万 tokens 公司动态
智谱采用国产原创 GLM 架构,已在香港联交所上市(股票代码 02513.HK);新用户注册即享 2000 万 tokens 体验额度,多模态方向另有 GLM-Image 图像生成与 CogVideoX-3 视频生成等模型。
查看原文 →
数据源:https://www.zhipuai.cn/news
通义 Qwen
中国 · 开源 / API
4 项更新
阿里云百炼本期重磅上新:旗舰 Qwen3.7-Max 已上线并开启推理限时 5 折(至 7 月 23 日);配套 Qwen3.7-Plus 多模态智能体、Qwen3.5-LiveTranslate 实时同传,以及 HuggingFace 上活跃的 Qwen3.5 开源系列与 Qwen-AgentWorld。
旗舰 Qwen3.7-Max 上线,推理限时 5 折 新模型
阿里云百炼上线面向智能体时代的新一代旗舰 Qwen3.7-Max,主打编程、办公自动化与长周期任务自主执行,支持 Token Plan 抵扣;即日起至 7 月 23 日推理后付费享限时 5 折。配套 Qwen3.7-Plus 为多模态智能体模型,既能看懂界面、操作应用,也能写代码、交付结果,实现「看、想、写、做、验」端到端闭环。
查看原文 →
Qwen3.5-LiveTranslate 实时同传上线 多模态
Qwen3.5-LiveTranslate 基于 Qwen3.5-Omni 基座,覆盖 60 种语言、可说 29 种语言,实现约 2.5 秒低延迟音视频同传,并支持实时克隆原声,让跨语言交流更自然。
查看原文 →
发布 Qwen-AgentWorld 语言世界模型系列 2026-06-23 Agent
通义千问在 HuggingFace 发布 Qwen-AgentWorld 系列,论文《Qwen-AgentWorld: Language World Models for General Agents》约于 6 月 23 日公开。开源 Qwen-AgentWorld-35B-A3B(约 350 亿参数、MoE 架构,近期下载量约 4.5 万)及配套 AgentWorldBench 评测集,聚焦为通用智能体构建语言世界模型。
查看原文 →
开源主力更新至 Qwen3.5 系列 开源模型
HuggingFace 上 Qwen 组织近日持续更新 Qwen3.5-0.8B / 2B / 4B 等小尺寸开源模型(新增 IFStruct v1.0 评测结果),配合 Qwen3-TTS 语音合成、Wan2.7-Image 图像生成与 Wan2.7-T2V/R2V 视频生成,构成从文本到多模态的完整开源矩阵。
查看原文 →
数据源:https://qwen.ai/blog
Kimi 月之暗面
中国 · API
2 项更新
月之暗面 Kimi 近期发布当前最强 Coding 模型 Kimi K2.7 Code 并上线高速版、配合限时促销;主力多模态模型 Kimi K2.6 支持 256K 上下文与文本/图片/视频输入。
发布最强 Coding 模型 Kimi K2.7 Code 新模型
Kimi 开放平台公告 Kimi K2.7 Code 模型正式发布,为 Kimi 当前最强 Coding 模型,高速版同步上线,并配合限时促销活动,面向代码编写与 Agent 场景。
查看原文 →
多模态主力 Kimi K2.6,支持 256K 上下文 2026-04-20 多模态
Kimi K2.6 是 Kimi 最新最智能的模型,具备更强更稳的长程代码编写能力,同时支持文本、图片与视频输入,支持 256K 上下文长度,具备原生多模态理解与较强的 Agent 性能。(研究页显示 K2.6 发布于 2026-04-20,为窗口外但仍是当前主力多模态模型。)
查看原文 →
数据源:https://platform.moonshot.cn/docs/api/changelog
豆包 / 字节 Seed
中国 · 开源 / API
3 项更新
字节跳动 Seed 团队 6 月 23 日正式发布 Seed2.1,主题为「深入 AI 生产力」;火山方舟文档已将 Seed 2.1 列为最新模型,配套 Seedance 2.0 视频与 Seedream 5.0 Lite 图像模型。
Seed2.1 正式发布,深入 AI 生产力 2026-06-23 新模型
字节跳动 Seed 团队于 2026 年 6 月 23 日正式发布 Seed2.1,官方主题为「深入 AI 生产力」,面向生产力场景强化模型能力;火山方舟(豆包方舟)文档已将 Seed 2.1 标注为最新模型。(模型详情页为前端渲染,未抓到更细的技术参数。)
查看原文 →
Seed3D 2.0 发布,3D 生成精度提升 2026-04-23 新模型
此前发布 Seed3D 2.0,主打更高精度与更强可用性的 3D 内容生成能力,面向游戏、数字资产等场景。
查看原文 →
Seed 全双工语音大模型发布 2026-04-09 语音
发布 Seed 全双工语音大模型,强调「懂倾听、抗干扰」,走向更自然的实时语音交互体验,配合 Seedance 2.0 视频生成与 Seedream 5.0 Lite 图像生成模型完善多模态矩阵。
查看原文 →
数据源:https://team.doubao.com/zh/blog
文心一言 / 百度
中国 · 闭源 / API
3 项更新
百度近 30 天以千帆/智能云产品更新为主:端到端语音语言大模型 Pro 版商用、文档解析 PaddleOCR-VL 1.6 升级(准确率 96.33% 登顶);文心旗舰 LLM 仍为 5 月发布的 ERNIE 5.1,登顶多项中文榜单。
端到端语音语言大模型 Pro 版开售 2026-06-17 商用
百度智能云端到端语音语言大模型 Pro 版正式商用开售,新用户最高可享 100 万免费 tokens,面向语音交互商用场景,主打「开口即真人」的自然交互体验。
查看原文 →
文档解析 PaddleOCR-VL 1.6 发布 2026-06-12 功能升级
文档解析(PaddleOCR-VL)升级至 1.6 版本,文本、表格、公式解析能力全面增强,官方称准确率 96.33% 登顶全球第一,新人专享 9 元/千页,适用于复杂版式文档的结构化提取。
查看原文 →
文心 ERNIE 5.1 发布(当前旗舰 LLM) 2026-05-09 新模型
文心 ERNIE 5.1 正式发布,官方称仅用同级模型约 6% 的预训练成本即达到领先性能,凭借全异步强化学习与规模化 Agent 后训练,在 Agent、推理与创作能力上全面升级,登顶 LMArena Search Arena 中文第一。发布日略早于本 30 天窗口,但为当前文心旗舰大语言模型,故一并纳入。
查看原文 →
数据源:https://ai.baidu.com/support/news
⚠️ 说明
本报告由 Baby Q 自动抓取整理,内容仅供参考。新模型/API/价格变更以厂商官方公告为准。报告每日 10:00(北京时间)自动更新。