报告生成时间 · 2026-07-01 10:14:40 (Asia/Shanghai)
报告日期
2026-07-01
覆盖厂商
9
新增更新
24
生成时间
2026-07-01 10:14:40 (Asia/Shanghai)
快速跳转
OpenAI · 5 Anthropic Claude · 4 Claude Code (CLI) · 3 DeepSeek 深度求索 · 2 智谱 GLM · 2 通义 Qwen · 2 Kimi 月之暗面 · 2 豆包 / 字节 Seed · 2 文心一言 / 百度 · 2
OpenAI
美国 · 闭源 API · ChatGPT
5 项更新
6 月 OpenAI 以平台侧能力打磨为主:GPT-5.5 稳居生产级旗舰(1M 上下文),chat-latest 快照持续跟随 ChatGPT 线上 Instant 模型;同时上线安全用量看板、Responses/Chat Completions 内置审核评分、Web 搜索返图,并对容器会话改为按分钟计费。
chat-latest 快照更新,跟随 ChatGPT 线上 Instant 模型 2026-06-24 API
OpenAI 更新了 chat-latest 快照,使其指向当前 ChatGPT 正在使用的最新 Instant 模型,快照底层会持续滚动更新。官方建议生产环境仍优先采用 GPT-5.5,chat-latest 适合用于体验对话场景的最新改进。
查看原文 →
上线 Safety Usage 安全用量看板 2026-06-23 安全
在 OpenAI API 平台发布 Safety Usage Dashboard,用于统计被安全策略拦截的 Responses 请求。看板按请求携带的 safety_identifier 值区分终端用户,帮助开发者定位违规调用来源、优化合规策略。
查看原文 →
Responses API Web 搜索支持返回图片结果 2026-06-09 功能
v1/responses 的 Web 搜索工具现可在文本结果之外同时返回图片结果。当应用需要产品图、地标、场所、活动等具时效性的网络视觉素材时,可启用图片搜索,适用于电商与实时资讯类场景。
查看原文 →
Responses / Chat Completions 新增审核评分 2026-06-04 安全
为 Responses API 与 Chat Completions API 加入 moderation 审核评分能力(omni-moderation-latest)。在生成请求中传入 moderation 对象,即可在同一次响应里同时获得模型输入与输出的审核结果,简化内容安全接入。
查看原文 →
代码解释器容器会话改为按分钟计费 2026-06-02 价格
自 2026 年 6 月 2 日起,符合条件的容器会话由原先按整段 20 分钟会话计费,改为按分钟计费并设 5 分钟起步下限,底层每分钟单价保持不变。对短时调用的开发者而言实际成本明显下降。
查看原文 →
数据源:https://platform.openai.com/docs/changelog
Anthropic Claude
美国 · 闭源 API · Claude
4 项更新
6 月 Anthropic 密集发布:月底推出新一代旗舰 Claude Sonnet 5,配套面向科研的 Claude Science 工作台与团队协作入口 Claude Tag,并在韩国设立首尔办公室、扩展受监管行业合作(TCS、DXC)。
发布新一代旗舰 Claude Sonnet 5 2026-06-30 新模型
Anthropic 推出 Claude Sonnet 5,在编程、智能体(agents)与专业工作场景实现规模化的前沿性能。该模型原生支持 1M token 上下文窗口,并在 8 月 31 日前提供每百万 token 输入 $2、输出 $10 的促销定价,同步成为 Claude Code 的默认模型。
查看原文 →
推出面向科学家的 Claude Science 工作台 2026-06-30 功能
Claude Science 是一款可定制的 AI 科研工作台,集成研究人员最常用的工具与软件包,能产出可审计(auditable)的工作产物,并提供对算力资源的灵活访问,用于加速科研工作流。
查看原文 →
推出团队协作新入口 Claude Tag 2026-06-23 功能
Claude Tag 是面向团队的全新协作方式,让团队成员以更结构化的方式与 Claude 协同工作,聚焦多人共享上下文与任务分派场景。
查看原文 →
设立首尔办公室,扩展韩国 AI 生态合作 2026-06-17 公司动态
Anthropic 宣布在韩国首尔开设办公室,并公布与韩国 AI 生态多方的新合作。此前 6 月还宣布 TCS、DXC 将把 Claude 集成进银行、航空等受监管行业的系统,加速企业侧落地。
查看原文 →
数据源:https://www.anthropic.com/news
Claude Code (CLI)
美国 · 命令行 Coding Agent
3 项更新
Claude Code 保持高频迭代,最新 2.1.197 随 Claude Sonnet 5 落地并将其设为默认模型;近期版本强化组织默认模型、后台会话可靠性、MCP 安全审批与自动模式(auto-mode)分类能力。
v2.1.197:Claude Sonnet 5 成为默认模型 2026-06-30 新模型
引入 Claude Sonnet 5 并将其设为 Claude Code 的默认模型,原生 1M token 上下文,8 月 31 日前享每百万 token $2/$10 促销定价。用户需升级到 2.1.197 版本方可使用。
查看原文 →
v2.1.196:组织默认模型与后台会话增强 功能
新增组织默认模型(admin 在企业控制台设置,/model 中显示为 Org default)、会话可读默认命名、聊天内可点击的文件附件。安全方面,claude mcp list/get 不再自动拉起仓库自审批的 MCP 服务,未受信任工作区显示待审批状态;并修复了后台任务唤醒、速率限制遥测重复计数等问题。
查看原文 →
v2.1.193:自动模式 Shell 分类与遥测增强 功能
新增 autoMode.classifyAllShell 设置,可将全部 Bash/PowerShell 命令都送入自动模式分类器判定,而非仅任意代码执行模式;将自动模式拒绝原因写入 transcript、拒绝提示与 /permissions 记录;并新增记录模型响应文本的 OpenTelemetry 日志事件(默认脱敏)。
查看原文 →
数据源:https://github.com/anthropics/claude-code/blob/main/CHANGELOG.md
DeepSeek 深度求索
中国 · 开源/开放 API
2 项更新
DeepSeek 官网首页当前主推 DeepSeek-V4 预览版,主打世界顶级推理性能与大幅增强的 Agent 能力,已在网页端、App 与 API 全线上线;API 侧 V4-Pro / V4-Flash 已开放调用,旧版模型名将于 7 月下旬退役。
DeepSeek-V4 上线:V4-Pro / V4-Flash 开放 API 2026-04-24 新模型
官网首页公告 DeepSeek-V4 预览版发布,具备世界顶级推理性能、Agent 能力大幅提高,已在网页端、App 和 API 上线。据 API 更新日志(记录日期 2026-04-24),DeepSeek API 已支持 deepseek-v4-pro 与 deepseek-v4-flash 两个模型,兼容 OpenAI ChatCompletions 与 Anthropic 两种接口,base_url 保持不变。
查看原文 →
旧模型名 deepseek-chat / deepseek-reasoner 将于 7 月下旬退役 2026-04-24 API
两个旧版 API 模型名 deepseek-chat 与 deepseek-reasoner 将在三个月后(2026-07-24)停用。过渡期内,二者分别指向 deepseek-v4-flash 的非思考模式与思考模式,官方建议开发者尽快迁移至 V4 系列新模型名。
查看原文 →
数据源:https://api-docs.deepseek.com/zh-cn/updates
智谱 GLM
中国 · 开源 · GLM / MaaS
2 项更新
智谱 6 月上线并开源新一代 GLM-5.2,主打 Coding 与长程任务:在 Artificial Analysis 综合榜取 51 分、与 Anthropic/OpenAI 并列前三,为开源模型 SOTA,支持 1M 无损上下文,已纳入 GLM Coding Plan。
GLM-5.2 上线并开源:专注 Coding 与长程任务 2026-06-17 新模型
智谱发布并在 Hugging Face、ModelScope 开源 GLM-5.2。在 Artificial Analysis 综合榜单取得 51 分,与 Anthropic、OpenAI 并列全球前三,为开源模型 SOTA;支持 1M 无损上下文,在 SWE-bench-Verified 与 Terminal Bench 2.0 上分别取得 77.8 与 56.2 的开源最高分,超过 Gemini 3.0 Pro。整体 Coding 能力大致介于 Claude Opus 4.7 与 4.8 之间。
查看原文 →
GLM-5.2 引入 effort level 档位并纳入 GLM Coding Plan 2026-06-17 功能
GLM-5.2 新增 effort level(思考档位)控制,可在能力、速度与成本间灵活平衡;架构上提出 IndexShare,在每四层稀疏注意力层间复用同一索引器,将 1M 上下文下单 token 的 FLOPs 大幅降低。API 已上线并纳入 GLM Coding Plan,全量用户可用。
查看原文 →
数据源:https://docs.bigmodel.cn/cn/guide/models/text/glm-5
通义 Qwen
中国 · 阿里 · 开源/百炼 API
2 项更新
阿里云百炼当前主推面向智能体时代的 Qwen3.7 系列(Max / Plus),强化编程、办公自动化与长周期任务自主执行;同时上线 Qwen3.5-LiveTranslate 多语言实时音视频同传模型。
Qwen3.7 系列发布:Max 与 Plus 面向智能体时代 新模型
阿里云百炼平台上线 Qwen3.7 系列。Qwen3.7-Max 为全能智能体模型,具备编程、办公自动化、长周期任务自主执行等能力,支持 Token Plan 抵扣;Qwen3.7-Plus 为多模态智能体模型,既能看懂界面、操作应用,也能写代码交付结果。平台标注推理后付费限时折扣至 7 月 23 日。
查看原文 →
Qwen3.5-LiveTranslate 实时音视频同传上线 新模型
基于 Qwen3.5-Omni 基座的多语言实时音视频同传模型 Qwen3.5-LiveTranslate 已上线,可听懂 60 种语言、会说 29 种语言,面向跨语言实时交互与会议同传场景。
查看原文 →
数据源:https://help.aliyun.com/zh/model-studio/
Kimi 月之暗面
中国 · Kimi · 开放平台 API
2 项更新
月之暗面开放平台当前主推 Kimi K2.7 Code——号称 Kimi 目前最强 Coding 模型,高速版同步上线;旗舰多模态模型 Kimi K2.6 支持文本/图片/视频输入与 256K 上下文。
Kimi K2.7 Code 模型正式发布 新模型
Kimi 开放平台公告 K2.7 Code 模型已正式发布,定位为 Kimi 当前最强的 Coding 模型,高速版已同步上线,并配合限时促销活动。官方页面未标注具体发布日期。
查看原文 →
Kimi K2.6 多模态旗舰模型 2026-04-20 新模型
Kimi K2.6 是月之暗面最新最智能的旗舰模型,具备更强更稳的长程代码编写能力,原生支持文本、图片与视频输入,上下文长度达 256K,是当前多模态与 Agent 场景的主力模型。
查看原文 →
数据源:https://platform.moonshot.cn/docs/api/changelog
豆包 / 字节 Seed
中国 · 字节跳动 · 火山方舟 API
2 项更新
字节跳动 Seed 团队 6 月正式发布 Seed2.1,主打「深入 AI 生产力」,为火山方舟平台当前主推的最新模型;此前 4 月已陆续推出 Seed3D 2.0 与全双工语音大模型。
Seed2.1 正式发布,深入 AI 生产力 2026-06-23 新模型
字节跳动 Seed 团队正式发布新一代大模型 Seed2.1,主题聚焦「深入 AI 生产力」,已成为火山方舟(Volcengine)平台标注的最新模型。团队博客为前端渲染页面,未能抓取到完整技术参数明细,具体上下文长度与定价以火山方舟官方文档为准。
查看原文 →
Seed3D 2.0 发布:更高精度、更强可用性 2026-04-23 新模型
Seed 团队发布 Seed3D 2.0,面向 3D 内容生成,主打更高的生成精度与更强的实际可用性。此前 4 月 9 日还发布了 Seed 全双工语音大模型,强调「懂倾听、抗干扰」,走向更自然的语音交互。
查看原文 →
数据源:https://team.doubao.com/zh/blog
文心一言 / 百度
中国 · 百度 · 千帆 / 文心
2 项更新
文心核心模型最新为 5 月发布的文心 5.1,多榜登顶、Arena 搜索榜国内第一,仅用约 6% 预训练成本达到同级效果;6 月百度智能云侧更新以语音、OCR 等能力为主(端到端语音 Pro、PaddleOCR-VL 1.6)。
文心 5.1 正式发布,多榜登顶 2026-05-09 新模型
文心 5.1 正式上线,仅使用业界同规模模型约 6% 的预训练成本即实现同级别效果领先。通过分离式全异步强化学习与规模化智能体后训练,在 Agent、推理、创作等多维度全面升级,LMArena 搜索榜国内第一。这是文心当前最新的核心大模型版本。
查看原文 →
百度智能云端到端语音语言大模型 Pro 版商用 2026-06-17 功能
百度智能云侧 6 月上线端到端语音语言大模型 Pro 版并开启商用,主打「开口即真人」的语音交互体验,新用户最高可享 100 万免费 tokens。此外 6 月 12 日发布文档解析 PaddleOCR-VL 1.6,文本/表格/公式解析能力全面增强。
查看原文 →
数据源:https://yiyan.baidu.com/blog/zh/
⚠️ 说明
本报告由 Baby Q 自动抓取整理,内容仅供参考。新模型/API/价格变更以厂商官方公告为准。报告每日 10:00(北京时间)自动更新。