报告生成时间 · 2026-07-03 10:11:38 (Asia/Shanghai)
报告日期
2026-07-03
覆盖厂商
9
新增更新
31
生成时间
2026-07-03 10:11:38 (Asia/Shanghai)
快速跳转
OpenAI · 5 Anthropic Claude · 5 Claude Code (CLI) · 4 DeepSeek 深度求索 · 2 智谱 GLM · 4 通义 Qwen · 3 Kimi 月之暗面 · 2 豆包 / 字节 Seed · 3 文心一言 / 百度 · 3
OpenAI
美国 · 闭源 API · ChatGPT
5 项更新
6 月 OpenAI 围绕旗舰 GPT-5.5 持续完善 API 能力:Web 搜索新增图像结果、Responses/Chat 接口内置审核评分、上线安全用量看板,并将模型上架 Amazon Bedrock;同时公布多项功能下线计划。
chat-latest 快照更新 2026-06-24 模型
更新 chat-latest 快照,指向 ChatGPT 当前使用的最新 Instant 模型。官方建议生产环境仍优先使用 GPT-5.5,chat-latest 主要用于测试面向对话场景的最新改进,底层快照会持续滚动更新。
查看原文 →
安全用量看板 Safety Usage Dashboard 上线 2026-06-23 安全
在 OpenAI API 平台推出 Safety Usage Dashboard,基于请求中携带的 safety_identifier 展示被安全策略拦截的 Responses 请求统计,帮助开发者识别触发拦截的终端用户与调用模式。
查看原文 →
Web 搜索工具支持返回图像结果 2026-06-09 API
Responses API 的 Web 搜索工具现可在文本结果之外返回图像结果,适用于需要实时或网络佐证的视觉内容场景,如商品图、地标、地点、活动与视觉参考等。
查看原文 →
Responses / Chat Completions 新增内容审核评分 2026-06-04 安全
在 Responses API 与 Chat Completions API 中加入内容审核评分:请求里传入 moderation 对象,即可在同一响应中同时获得模型输入与生成输出的审核结果,底层基于 omni-moderation-latest 审核模型。
查看原文 →
OpenAI 模型上架 Amazon Bedrock,并公布多项下线计划 2026-06-01 API
GPT-5.4、GPT-5.5 等模型通过兼容 Responses API 的端点在 Amazon Bedrock 上线,支持的模型与功能因 AWS 区域而异。旗舰 GPT-5.5 支持 100 万 token 上下文窗口;同期宣布可复用 prompt 对象、Evals 平台与 Agent Builder 的下线时间表。
查看原文 →
数据源:https://platform.openai.com/docs/changelog
Anthropic Claude
美国 · 闭源 API · Claude
5 项更新
6 月末 Anthropic 迎来重磅节点:发布新一代主力模型 Claude Sonnet 5,并推出面向科研的 Claude Science 与团队协作的 Claude Tag;公司层面加速企业落地与国际化布局(首尔办公室、TCS/DXC 合作)。
发布新一代主力模型 Claude Sonnet 5 2026-06-30 新模型
推出 Claude Sonnet 5,官方称其在编程、智能体与专业工作等场景实现前沿性能并可大规模落地。据 Claude Code 更新日志,Sonnet 5 原生支持 100 万 token 上下文窗口,并在 8 月 31 日前提供每百万 token 输入 2 美元、输出 10 美元的促销定价。
查看原文 →
科研工作台 Claude Science 正式可用 2026-06-30 产品
面向科研人员的 Claude Science 上线,集成研究者最常用的工具与软件包,产出可审计的分析产物,并提供灵活的算力接入,帮助科学家在同一环境内完成数据处理、推理与结果复现。
查看原文 →
推出团队协作新方式 Claude Tag 2026-06-23 产品
面向团队场景推出 Claude Tag,为团队提供一种与 Claude 协同工作、标注与分派任务的新方式。
查看原文 →
设立首尔办公室,深化韩国 AI 生态合作 2026-06-17 公司动态
Anthropic 宣布在首尔开设办公室,并与韩国 AI 生态多家伙伴达成新的合作,加速亚太区域业务扩张。
查看原文 →
TCS、DXC 合作将 Claude 引入受监管行业 2026-06-11 公司动态
与 TCS 合作把 Claude 带入受监管行业;DXC 将把 Claude 集成进银行、航空等受监管系统所依赖的基础设施。同期还公布了首份 Anthropic Public Record 的结果。
查看原文 →
数据源:https://www.anthropic.com/news
Claude Code (CLI)
美国 · 命令行编程工具
4 项更新
Claude Code 保持高频迭代至 v2.1.199。核心亮点是 v2.1.197 引入 Claude Sonnet 5 作为默认模型;近期版本大幅强化后台子代理、稳定性与错误处理。
v2.1.199:技能堆叠调用与大量稳定性修复 功能/修复
支持堆叠式斜杠技能调用(如 /skill-a /skill-b,最多加载前 5 个技能);SSL 证书错误现快速失败并直接给出修复提示;修复流式响应在中途服务端错误时被丢弃、子代理被限流后静默失败、后台守护进程异常自杀等问题;非容量类 429 瞬时错误现自动退避重试。
查看原文 →
v2.1.198:子代理默认后台运行、Chrome 版全量上线 功能
子代理默认在后台运行,主代理可继续工作并在其完成时收到通知;Claude in Chrome 正式全量可用;新增后台代理通知(agent_needs_input / agent_completed)与 /dataviz 图表设计技能;后台代理完成代码工作后会自动提交、推送并开草稿 PR。
查看原文 →
v2.1.197:引入 Claude Sonnet 5 为默认模型 新模型
将 Claude Sonnet 5 设为 Claude Code 默认模型,原生 100 万 token 上下文窗口,8 月 31 日前促销定价为每百万 token 输入 2 美元、输出 10 美元,需升级到 2.1.197 使用。
查看原文 →
v2.1.196:组织默认模型与 MCP 安全增强 功能/安全
支持组织默认模型(管理员在控制台设置,/model 中显示为 Org default);安全增强方面,claude mcp list/get 不再自动拉起仓库自审批的 .mcp.json 服务器,未受信工作区会显示为待批准状态。
查看原文 →
数据源:https://raw.githubusercontent.com/anthropics/claude-code/main/CHANGELOG.md
DeepSeek 深度求索
中国 · 开源 / API
2 项更新
DeepSeek 官网当前首页头条为 DeepSeek-V4,主打世界顶级推理与大幅增强的 Agent 能力,已在网页端、App 与 API 全面上线;旧版模型名将于 7 月下旬停用。
DeepSeek-V4 成为主力,全平台上线 新模型
官网首页头条为 DeepSeek-V4 预览版,宣称具备世界顶级推理性能、Agent 能力大幅提高,已在网页端、App 与 API 上线。API 侧提供 deepseek-v4-pro 与 deepseek-v4-flash 两款模型,兼容 OpenAI ChatCompletions 与 Anthropic 接口,base_url 保持不变、仅需改 model 参数。
查看原文 →
旧模型名 deepseek-chat / deepseek-reasoner 将停用 2026-07-24 API
旧接口模型名 deepseek-chat 与 deepseek-reasoner 将于 2026-07-24 15:59 UTC 停止使用。过渡期内二者分别指向 deepseek-v4-flash 的非思考模式与思考模式,开发者需尽快迁移到 v4 系列新模型名。
查看原文 →
数据源:https://www.deepseek.com/
智谱 GLM
中国 · 开源 / API
4 项更新
智谱当前主力为新一代旗舰 GLM-5.2,已开源并主打编程能力开源 SOTA、支持 100 万无损上下文;配套推出多模态编程模型 GLM-5V-Turbo 与 Agent 基座 GLM-5-Turbo、AutoGLM。(官网新闻页未标注精确发布日期)
旗舰模型 GLM-5.2 上线并开源 新模型
智谱上线并开源新一代旗舰模型 GLM-5.2,在 Artificial Analysis 综合榜单取得 51 分,与 Anthropic、OpenAI 同列前三,为开源模型 SOTA。Coding 能力开源 SOTA,支持 100 万无损上下文,长程任务执行更稳定、工程规范遵循更可靠。
查看原文 →
多模态编程模型 GLM-5V-Turbo 多模态
推出多模态 Coding 模型 GLM-5V-Turbo,原生融合视觉与文本能力,针对视觉编程与 Agent 类任务进行专项优化。
查看原文 →
Agent 基座 GLM-5-Turbo 与 AutoGLM 功能
GLM-5-Turbo 为 Agent 场景打造的基座模型,从训练层深度优化工具调用与长链路执行能力;AutoGLM 具备自主规划、推理与执行能力,可持续自我改进。
查看原文 →
公司动态:港股上市厂商,注册赠 2000 万 tokens 公司动态
智谱为中国大型独立大模型厂商,采用国产原创 GLM 架构,已在香港联交所上市(股票代码 02513.HK);新用户注册即享 2000 万 tokens 体验额度。
查看原文 →
数据源:https://www.zhipuai.cn/news
通义 Qwen
中国 · 开源 / API
3 项更新
官方 github.io 博客暂未更新最新内容,数据取自 HuggingFace 官方组织与阿里云百炼文档:近期在 HuggingFace 发布 Qwen-AgentWorld 系列(面向通用智能体的语言世界模型);API 侧最新旗舰为 qwen3.7-max,开源主力为 Qwen3.6 系列。
发布 Qwen-AgentWorld 语言世界模型系列 2026-06-23 Agent
通义千问在 HuggingFace 发布 Qwen-AgentWorld 系列,论文《Qwen-AgentWorld: Language World Models for General Agents》于 6 月 23 日公开。开源 Qwen-AgentWorld-35B-A3B(约 346 亿参数、MoE 架构)及配套 AgentWorldBench 评测集,聚焦为通用智能体构建语言世界模型。
查看原文 →
API 最新旗舰 qwen3.7-max / qwen3.7-plus API
阿里云百炼平台文档显示,最新的 qwen3.7-max 推理能力全面超越前代,官方推荐优先选用;配套 qwen3.7-plus 面向通用、高性价比场景。
查看原文 →
开源主力 Qwen3.6 系列下载量破百万 开源模型
开源主力 Qwen3.6 系列(含 Qwen3.6-35B-A3B MoE 与 Qwen3.6-27B 稠密版)在 HuggingFace 累计下载量已达数百万,支持结构化输出与工具调用,多家第三方推理厂商提供服务。
查看原文 →
数据源:https://qwenlm.github.io/zh/blog/
Kimi 月之暗面
中国 · API
2 项更新
月之暗面 Kimi 近期发布当前最强 Coding 模型 Kimi K2.7 Code 并上线高速版;主力多模态模型 Kimi K2.6 支持 256K 上下文与文本/图片/视频输入。
发布最强 Coding 模型 Kimi K2.7 Code 新模型
Kimi 开放平台公告 Kimi K2.7 Code 模型正式发布,为 Kimi 当前最强 Coding 模型,高速版同步上线,并配合限时促销活动。
查看原文 →
多模态主力 Kimi K2.6,支持 256K 上下文 2026-04-20 多模态
Kimi K2.6 是 Kimi 最新最智能的模型,具备更强更稳的长程代码编写能力,同时支持文本、图片与视频输入,支持 256K 上下文长度,并具备原生多模态理解与较强的 Agent 性能。
查看原文 →
数据源:https://platform.moonshot.cn/docs/api/changelog
豆包 / 字节 Seed
中国 · 开源 / API
3 项更新
字节跳动 Seed 团队 6 月 23 日正式发布 Seed2.1,主打深入 AI 生产力;火山引擎文档已将 Seed 2.1 列为最新模型。
Seed2.1 正式发布,深入 AI 生产力 2026-06-23 新模型
字节跳动 Seed 团队于 2026 年 6 月 23 日正式发布 Seed2.1,官方主题为深入 AI 生产力,面向生产力场景强化模型能力;火山引擎方舟文档已将 Seed 2.1 标注为最新模型。(模型详情页为前端渲染,未抓到更细的技术参数)
查看原文 →
Seed3D 2.0 发布 2026-04-23 新模型
此前发布 Seed3D 2.0,主打更高精度与更强可用性的 3D 内容生成能力。
查看原文 →
Seed 全双工语音大模型发布 2026-04-09 语音
发布 Seed 全双工语音大模型,强调懂倾听、抗干扰,走向更自然的实时语音交互体验。
查看原文 →
数据源:https://team.doubao.com/zh/blog
文心一言 / 百度
中国 · 闭源 / API
3 项更新
百度近 30 天以千帆平台的产品更新为主(端到端语音语言大模型 Pro 商用、文档解析 PaddleOCR-VL 1.6 升级);文心旗舰 LLM 当前为 5 月发布的 ERNIE 5.1,登顶多项中文榜单。
端到端语音语言大模型 Pro 版开售 2026-06-17 商用
百度智能云端到端语音语言大模型 Pro 版正式商用开售,最高可享 100 万免费 tokens,面向语音交互商用场景,主打开口即真人的自然交互体验。
查看原文 →
文档解析 PaddleOCR-VL 1.6 发布 2026-06-12 功能升级
文档解析(PaddleOCR-VL)升级至 1.6 版本,文本、表格、公式解析能力全面增强,适用于复杂版式文档的结构化提取。
查看原文 →
文心 ERNIE 5.1 发布(当前旗舰 LLM) 2026-05-09 新模型
文心 ERNIE 5.1 正式发布,仅用同级模型约 6% 的预训练成本即达到领先性能,凭借全异步强化学习与规模化 Agent 后训练,在 Agent、推理与创作能力上全面升级,登顶 Arena Search Arena 中文第一。发布日略早于本期 30 天窗口,但为当前文心旗舰大语言模型,故一并纳入。
查看原文 →
数据源:https://cloud.baidu.com/doc/WENXINWORKSHOP/index.html
⚠️ 说明
本报告由 Baby Q 自动抓取整理,内容仅供参考。新模型/API/价格变更以厂商官方公告为准。报告每日 10:00(北京时间)自动更新。