报告生成时间 · 2026-07-02 10:08:19 (Asia/Shanghai)
报告日期
2026-07-02
覆盖厂商
9
新增更新
26
生成时间
2026-07-02 10:08:19 (Asia/Shanghai)
快速跳转
OpenAI · 5 Anthropic Claude · 5 Claude Code (CLI) · 3 DeepSeek 深度求索 · 2 智谱 GLM · 2 通义 Qwen · 2 Kimi 月之暗面 · 2 豆包 / 字节 Seed · 2 文心一言 / 百度 · 3
OpenAI
美国 · 闭源 API · ChatGPT
5 项更新
OpenAI 近期以平台侧能力打磨为主:生产级旗舰仍为 GPT-5.5(1M 上下文),chat-latest 快照持续跟随 ChatGPT 线上 Instant 模型;6 月上线安全用量看板、Web 搜索返图、审核评分,并将容器会话改为按分钟计费,同时预告下线可复用 Prompt 对象、Evals 平台与 Agent Builder。
chat-latest 快照更新,跟随 ChatGPT 线上 Instant 模型 2026-06-24 API
OpenAI 更新 chat-latest 快照,使其指向当前 ChatGPT 正在使用的最新 Instant 模型,底层快照会持续滚动更新。官方建议生产环境仍优先采用 GPT-5.5,chat-latest 适合体验对话场景的最新改进。
查看原文 →
上线 Safety Usage 安全用量看板 2026-06-23 安全
在 OpenAI API 平台发布 Safety Usage Dashboard,用于统计被安全策略拦截的 Responses 请求。看板按请求携带的 safety_identifier 值区分终端用户,帮助开发者定位违规调用来源、优化合规策略。
查看原文 →
Responses API Web 搜索支持返回图片结果 2026-06-09 功能
v1/responses 的 Web 搜索工具现可在文本结果之外同时返回图片结果。当应用需要产品图、地标、场所、活动等具时效性的网络视觉素材时可启用图片搜索,适用于电商与实时资讯类场景。
查看原文 →
预告下线可复用 Prompt 对象、Evals 平台与 Agent Builder 2026-06-03 API
OpenAI 宣布将逐步弃用可复用的 prompt 对象、Evals 评测平台与 Agent Builder,具体停用时间线与迁移指南见 deprecations 页面。开发者需及时调整依赖上述能力的工作流。
查看原文 →
代码解释器容器会话改为按分钟计费 2026-06-02 价格
自 2026 年 6 月 2 日起,符合条件的容器会话由原先按整段 20 分钟会话计费,改为按分钟计费并设 5 分钟起步下限,底层每分钟单价保持不变。对短时调用的开发者而言实际成本明显下降。
查看原文 →
数据源:https://platform.openai.com/docs/changelog
Anthropic Claude
美国 · 闭源 API · Claude
5 项更新
6 月底 Anthropic 密集发布:推出新一代旗舰 Claude Sonnet 5(原生 1M 上下文、限时 $2/$10)、面向科研的 Claude Science 工作台与团队协作入口 Claude Tag;6 月 30 日起 Fable 5 全球恢复,并联合亚马逊、微软、谷歌等 Glasswing 伙伴提出行业级越狱严重性评分框架;此外在首尔设立办公室、扩展 TCS/DXC 等受监管行业合作。
发布新一代旗舰 Claude Sonnet 5 2026-06-30 新模型
Anthropic 推出 Claude Sonnet 5,在编程、智能体(agents)与专业工作场景实现规模化前沿性能。该模型原生支持 1M token 上下文窗口,8 月 31 日前提供每百万 token 输入 $2、输出 $10 的促销定价,并同步成为 Claude Code 的默认模型。
查看原文 →
Fable 5 全球恢复上线,联合提出越狱严重性评分框架 2026-06-30 安全
Anthropic 宣布 Fable 5 自 7 月 1 日起在全球恢复可用;同时联合亚马逊、微软、谷歌等 Glasswing 合作伙伴,提出一套行业通用的越狱(jailbreak)严重性评分框架,用于统一衡量和披露安全绕过的危害等级。
查看原文 →
推出面向科学家的 Claude Science 工作台 2026-06-30 功能
Claude Science 是一款可定制的 AI 科研工作台,集成研究人员最常用的工具与软件包,能产出可审计(auditable)的工作产物,并提供对算力资源的灵活访问,用于加速科研工作流。
查看原文 →
推出团队协作新入口 Claude Tag 2026-06-23 功能
Claude Tag 是面向团队的全新协作方式,让团队成员以更结构化的方式与 Claude 协同工作,聚焦多人共享上下文与任务分派场景。
查看原文 →
设立首尔办公室,扩展受监管行业合作 2026-06-17 公司动态
Anthropic 宣布在韩国首尔开设办公室并公布多方合作。6 月还宣布 TCS、DXC 将把 Claude 集成进银行、航空等受监管行业系统,并发布首份 Anthropic Public Record 结果,加速企业侧落地。
查看原文 →
数据源:https://www.anthropic.com/news
Claude Code (CLI)
美国 · 命令行 Coding Agent
3 项更新
Claude Code 保持高频迭代,最新 2.1.198 让 Claude in Chrome 全量可用,并为后台 Agent 加入通知钩子、新增 /dataviz 图表设计技能、接入 AWS 上的 Claude 平台作为上游;2.1.197 随 Claude Sonnet 5 落地并将其设为默认模型,原生 1M 上下文、限时 $2/$10。
v2.1.198:Claude in Chrome 全量可用,后台 Agent 自动提交 PR 功能
Claude in Chrome 正式全量开放(GA);新增后台 Agent 通知钩子(agent_needs_input / agent_completed),从 claude agents 启动的后台 Agent 在完成工作树内的代码后会自动 commit、push 并开启草稿 PR,而非停下询问;新增 /dataviz 图表与仪表盘设计技能(含可运行的配色校验器),网关接入 AWS 上的 Claude 平台(anthropicAws)作为上游 provider,并修复大量后台任务卡「Running」、断网重试等问题。
查看原文 →
v2.1.197:Claude Sonnet 5 成为默认模型 新模型
引入 Claude Sonnet 5 并将其设为 Claude Code 的默认模型,原生 1M token 上下文,8 月 31 日前享每百万 token $2/$10 促销定价。用户需升级到 2.1.197 版本方可使用。
查看原文 →
v2.1.196:组织默认模型与后台会话增强 功能
新增组织默认模型(admin 在企业控制台设置,/model 中显示为 Org default)、会话可读默认命名、聊天内可点击的文件附件。安全方面,claude mcp list/get 不再自动拉起仓库自审批的 MCP 服务,未受信任工作区显示待审批状态。
查看原文 →
数据源:https://github.com/anthropics/claude-code/blob/main/CHANGELOG.md
DeepSeek 深度求索
中国 · 开源/开放 API
2 项更新
DeepSeek 官网首页当前主推 DeepSeek-V4 预览版,主打世界顶级推理性能与大幅增强的 Agent 能力,已在网页端、App 与 API 全线上线;API 侧 V4-Pro / V4-Flash 已开放调用,旧版模型名将于 7 月下旬退役。
DeepSeek-V4 上线:V4-Pro / V4-Flash 开放 API 2026-04-24 新模型
官网首页公告 DeepSeek-V4 预览版发布,具备世界顶级推理性能、Agent 能力大幅提高,已在网页端、App 和 API 上线。据 API 更新日志(记录日期 2026-04-24),DeepSeek API 已支持 deepseek-v4-pro 与 deepseek-v4-flash 两个模型,兼容 OpenAI ChatCompletions 与 Anthropic 两种接口,base_url 保持不变。
查看原文 →
旧模型名 deepseek-chat / deepseek-reasoner 将于 7 月下旬退役 2026-04-24 API
两个旧版 API 模型名 deepseek-chat 与 deepseek-reasoner 将在三个月后(2026-07-24)停用。过渡期内二者分别指向 deepseek-v4-flash 的非思考模式与思考模式,官方建议开发者尽快迁移至 V4 系列新模型名。
查看原文 →
数据源:https://www.deepseek.com/
智谱 GLM
中国 · 开源 · GLM / MaaS
2 项更新
智谱当前主推并开源的旗舰仍为 GLM-5.2,专注 Coding 与长程任务:在 Artificial Analysis 综合榜取 51 分、与 Anthropic/OpenAI 并列前三,为开源模型 SOTA,支持 1M 无损上下文,已纳入 GLM Coding Plan;同时提供多模态基座 GLM-5V-Turbo 与 Agent 基座 GLM-5-Turbo。
GLM-5.2 上线并开源:专注 Coding 与长程任务 2026-06-17 新模型
智谱发布并在 Hugging Face、ModelScope 开源 GLM-5.2。在 Artificial Analysis 综合榜单取得 51 分,与 Anthropic、OpenAI 并列全球前三,为开源模型 SOTA;支持 1M 无损上下文,在 SWE-bench-Verified 与 Terminal Bench 2.0 上分别取得 77.8 与 56.2 的开源最高分。整体 Coding 能力大致介于 Claude Opus 4.7 与 4.8 之间。
查看原文 →
GLM-5.2 引入 effort level 档位并纳入 GLM Coding Plan 2026-06-17 功能
GLM-5.2 新增 effort level(思考档位)控制,可在能力、速度与成本间灵活平衡;架构上提出 IndexShare,在每四层稀疏注意力层间复用同一索引器,将 1M 上下文下单 token 的 FLOPs 大幅降低。API 已上线并纳入 GLM Coding Plan,全量用户可用。
查看原文 →
数据源:https://docs.bigmodel.cn/cn/guide/models/text/glm-5
通义 Qwen
中国 · 阿里 · 开源/百炼 API
2 项更新
阿里云百炼当前主推面向智能体时代的 Qwen3.7 系列(Max / Plus),强化编程、办公自动化与长周期任务自主执行;同时提供高性价比的 Qwen3.6-Flash,以及基于 Qwen3.5-Omni 的多语言实时音视频同传能力。
Qwen3.7 系列上线百炼:Max 与 Plus 面向智能体时代 新模型
阿里云百炼平台在架主推 Qwen3.7 系列。qwen3.7-max 定位全能智能体模型,具备编程、办公自动化、长周期任务自主执行等能力;qwen3.7-plus 为多模态智能体模型,既能看懂界面、操作应用,也能写代码交付结果。两者均提供 OpenAI 兼容、Anthropic 兼容与 DashScope 三种接口,覆盖北京、新加坡、东京、法兰克福、弗吉尼亚等多区域。
查看原文 →
Qwen3.6-Flash 提供高性价比推理档位 新模型
百炼同时在架 qwen3.6-flash,作为主打低成本、高吞吐的轻量档位模型,与 Qwen3.7-Max / Plus 形成「能力最强到成本最低,按需选择」的完整梯度;配合 Qwen3.5-Omni 系列覆盖多模态与实时音视频交互场景。
查看原文 →
数据源:https://help.aliyun.com/zh/model-studio/models
Kimi 月之暗面
中国 · Kimi · 开放平台 API
2 项更新
月之暗面开放平台当前主推 Kimi K2.7 Code——号称 Kimi 目前最强 Coding 模型,高速版同步上线并配合限时促销;旗舰多模态模型 Kimi K2.6 原生支持文本/图片/视频输入与 256K 上下文。
Kimi K2.7 Code 模型正式发布 新模型
Kimi 开放平台公告 K2.7 Code 模型已正式发布,定位为 Kimi 当前最强的 Coding 模型,高速版已同步上线,并配合限时促销活动进行中。官方页面未标注具体发布日期。
查看原文 →
Kimi K2.6 多模态旗舰模型 2026-04-20 新模型
Kimi K2.6 是月之暗面最新最智能的旗舰模型,具备更强更稳的长程代码编写能力,原生支持文本、图片与视频输入,上下文长度达 256K,是当前多模态与 Agent 场景的主力模型。
查看原文 →
数据源:https://platform.moonshot.cn/docs/api/changelog
豆包 / 字节 Seed
中国 · 字节跳动 · 火山方舟 API
2 项更新
字节跳动 Seed 团队 6 月 23 日正式发布 Seed2.1,主打「深入 AI 生产力」,为火山方舟平台当前主推的最新语言模型;此前 4 月已陆续推出 Seed3D 2.0 与全双工语音大模型。
Seed2.1 正式发布,深入 AI 生产力 2026-06-23 新模型
字节跳动 Seed 团队正式发布新一代大模型 Seed2.1,主题聚焦「深入 AI 生产力」,为团队博客在架标注的最新模型成果。团队博客为前端渲染页面,未能抓取到完整技术参数明细,具体上下文长度与定价以火山方舟(Volcengine)官方文档为准。
查看原文 →
Seed3D 2.0 发布:更高精度、更强可用性 2026-04-23 新模型
Seed 团队发布 Seed3D 2.0,面向 3D 内容生成,主打更高的生成精度与更强的实际可用性。此前 4 月 9 日还发布了 Seed 全双工语音大模型,强调「懂倾听、抗干扰」,走向更自然的语音交互。
查看原文 →
数据源:https://team.doubao.com/zh/blog
文心一言 / 百度
中国 · 百度 · 千帆 / 文心
3 项更新
文心核心模型最新为 5 月发布的文心 5.1,多榜登顶、Arena 搜索榜国内第一,仅用约 6% 预训练成本达到同级效果;6 月百度智能云侧更新以语音、OCR 等云能力为主(端到端语音 Pro 商用、PaddleOCR-VL 1.6)。
百度智能云端到端语音语言大模型 Pro 版商用开售 2026-06-17 功能
百度智能云端到端语音语言大模型 Pro 版正式商用开售,主打「开口即真人」的语音交互体验,新用户最高可享 100 万免费 tokens。这是 6 月百度侧公开的重点云能力更新之一。
查看原文 →
文档解析 PaddleOCR-VL 1.6 发布,准确率登顶全球第一 2026-06-12 功能
百度发布文档解析 PaddleOCR-VL 1.6,文本、表格、公式解析能力全面增强,准确率 96.33% 登顶全球第一,新人专享 9 元/千页。此外 5 月 29 日还上线了「通用卡证票据识别」与「AI 修图」两项公测能力。
查看原文 →
文心 5.1 正式发布,多榜登顶 2026-05-09 新模型
文心 5.1 正式上线,仅使用业界同规模模型约 6% 的预训练成本即实现同级别效果领先。通过分离式全异步强化学习与规模化智能体后训练,在 Agent、推理、创作等多维度全面升级,LMArena 搜索榜国内第一。这是文心当前最新的核心大模型版本。
查看原文 →
数据源:https://yiyan.baidu.com/blog/zh/
⚠️ 说明
本报告由 Baby Q 自动抓取整理,内容仅供参考。新模型/API/价格变更以厂商官方公告为准。报告每日 10:00(北京时间)自动更新。