报告生成时间 · 2026-07-05 10:05:00 (Asia/Shanghai)
报告日期
2026-07-05
覆盖厂商
9
新增更新
29
生成时间
2026-07-05 10:05:00 (Asia/Shanghai)
快速跳转
OpenAI · 5 Anthropic Claude · 5 Claude Code (CLI) · 4 DeepSeek 深度求索 · 1 智谱 GLM · 4 通义 Qwen · 4 Kimi 月之暗面 · 2 豆包 / 字节 Seed · 3 文心一言 / 百度 · 1
OpenAI
美国 · 闭源 API · ChatGPT
5 项更新
近 30 天 OpenAI 围绕旗舰 GPT-5.5(文档导航标注 100 万 token 上下文)持续打磨 API 与平台安全:Web 搜索返回图像、内置内容审核评分、上线安全用量看板,并把模型上架 Amazon Bedrock;同时清理可复用 prompt、Evals、Agent Builder 等旧能力。本窗口内暂无全新旗舰模型发布。
chat-latest 快照更新至最新 Instant 模型 2026-06-24 模型
更新 chat-latest 快照,使其指向 ChatGPT 当前使用的最新 Instant 模型。官方建议生产环境固定使用带版本号的 GPT-5.5 快照,而非跟随 chat-latest 滚动更新,以保证行为稳定。
查看原文 →
安全用量看板 Safety Usage Dashboard 上线 2026-06-23 安全
在 OpenAI API 平台推出 Safety Usage Dashboard,基于请求中携带的 safety_identifier 值,按终端用户维度展示被安全策略拦截的 Responses 请求量,方便开发者定位违规调用来源、优化合规策略。
查看原文 →
Responses API 的 Web 搜索工具支持返回图像结果 2026-06-09 API
Web 搜索工具(v1/responses)现可在文本结果之外同时返回图像结果。当应用需要实时或联网视觉素材(如商品图、地标、活动现场、视觉参考)时可启用图像搜索,增强多模态检索场景。
查看原文 →
Responses / Chat Completions 新增内容审核评分 2026-06-04 安全
基于 omni-moderation-latest,为 Responses API 与 Chat Completions API 增加 moderation 评分能力,可在生成链路中直接获取内容风险分值,简化合规过滤与内容安全处理流程。
查看原文 →
GPT-5.4 / GPT-5.5 上架 Amazon Bedrock 2026-06-01 API
OpenAI 模型开始通过 OpenAI 兼容的 Responses API 端点在 Amazon Bedrock 提供,企业用户可在 AWS 生态内直接调用 GPT-5.4 / GPT-5.5。同期(6-03)宣布下线可复用 prompt 对象、Evals 平台与 Agent Builder,迁移时间线见 deprecations 页。
查看原文 →
数据源:https://platform.openai.com/docs/changelog
Anthropic Claude
美国 · 闭源 API · Claude
5 项更新
6 月末 Anthropic 迎来密集节点:发布新一代主力模型 Claude Sonnet 5(原生 100 万 token 上下文),并推出面向科研的 Claude Science 工作台与团队协作入口 Claude Tag;此前因美政府 6/12 暂停令下架的 Fable 5 于 7/1 全球重新上线,并联合 Amazon、微软、谷歌等提出越狱严重程度评分框架。
补充 Fable 5 网络安全护栏与越狱评分框架细节 2026-07-02 安全
Anthropic 进一步披露 Fable 5 的网络安全护栏机制,并与 Amazon、微软、谷歌等 Glasswing 合作伙伴共同提出一套面向全行业的越狱(jailbreak)严重程度评分框架,推动统一的安全评估标准。
查看原文 →
发布新一代主力模型 Claude Sonnet 5 2026-06-30 新模型
Sonnet 5 在编程、Agent 与专业办公等场景提供前沿性能,并具备原生 100 万 token 上下文窗口(据 Claude Code 更新日志已同步设为其默认模型),面向大规模生产工作负载。
查看原文 →
Fable 5 于 7 月 1 日全球重新上线 2026-06-30 公司动态
在美政府 6/12 要求暂停 Fable 5 与 Mythos 5 访问后,Anthropic 宣布 Fable 5 于 7 月 1 日面向全球重新部署上线,同时公布配套的安全护栏与治理措施。
查看原文 →
科研工作台 Claude Science 正式可用 2026-06-30 产品
Claude Science 是面向科研人员的可定制应用,集成研究者常用工具与软件包,能产出可审计的中间产物(auditable artifacts),并提供灵活的算力资源接入,服务科学计算与研究工作流。
查看原文 →
推出团队协作新方式 Claude Tag 2026-06-23 产品
Claude Tag 是面向团队的全新协作方式,让多人团队以标签化方式与 Claude 协同工作。同月 Anthropic 还宣布开设首尔办公室并公布多项韩国 AI 生态合作。
查看原文 →
数据源:https://www.anthropic.com/news
Claude Code (CLI)
美国 · 命令行编程工具
4 项更新
Claude Code 保持高频迭代至 v2.1.201。近期核心变化:默认权限模式改为 Manual、AskUserQuestion 不再自动继续;此前 v2.1.198 将子代理默认改为后台运行且 Claude in Chrome 全量上线,v2.1.197 引入 Claude Sonnet 5 为默认模型并带来原生 100 万 token 上下文。
默认权限模式改为 Manual 版本 2.1.201 / 2.1.200 功能
将 CLI、--help、VS Code、JetBrains 中的默认权限模式由 default 改为 Manual;AskUserQuestion 对话框不再默认自动继续,可通过 /config 设置空闲超时。同时修复后台会话在休眠/唤醒后中断、daemon.lock 残留导致后台代理无法重启等问题。
查看原文 →
堆叠式技能调用与大量稳定性修复 版本 2.1.199 功能
堆叠式斜杠技能调用(如 /skill-a /skill-b do XYZ)现可加载全部前置技能(最多 5 个)。修复被限流打断的子代理误报为成功、429 瞬时限流对订阅用户自动退避重试等问题;CLAUDE_CODE_RETRY_WATCHDOG 将非容量类瞬时错误默认重试上限提升至 300。
查看原文 →
子代理默认后台运行、Claude in Chrome 全量上线 版本 2.1.198 功能
子代理默认改为后台运行,主代理可在其运行期间继续工作并在完成时收到通知;Claude in Chrome 全面可用(GA);新增 /dataviz 技能用于图表与仪表盘设计并附带可运行的配色校验器;网关新增 AWS 上游 Provider。
查看原文 →
引入 Claude Sonnet 5 为默认模型 版本 2.1.197 新模型
Claude Code 将默认模型切换为 Claude Sonnet 5,带来原生 100 万 token 上下文窗口;并支持组织级默认模型(管理员在 org 控制台设置,显示为 Org default)。
查看原文 →
数据源:https://github.com/anthropics/claude-code/blob/main/CHANGELOG.md
DeepSeek 深度求索
中国 · 开源 / API
1 项更新
官网首页仍以 DeepSeek-V4 预览版为头条(世界顶级推理性能、Agent 能力大幅提升,已在网页端、App 与 API 上线)。需说明:官方更新日志页 api-docs.deepseek.com/news 本次抓取返回 404,无法核实更细粒度的版本/价格时间线,故本期仅以首页可确认信息为准。
DeepSeek-V4 预览版发布,主打世界顶级推理与 Agent 当前首页头条 新模型
深度求索官网首页当前头条为 DeepSeek-V4 预览版本,官方描述其具备世界顶级推理性能、Agent 能力大幅提高,已在网页端、App 和 API 三端上线。因官方 news 更新日志页返回 404,本报告未能核实 V4 的精确发布日期、定价与上下文窗口等参数,谨以首页信息为准。
查看原文 →
数据源:https://www.deepseek.com/
智谱 GLM
中国 · 开源 / API
4 项更新
智谱当前主力为新一代旗舰 GLM-5.2:已开源,在 Artificial Analysis 综合榜单取得 51 分、与 Anthropic / OpenAI 同列前三,为开源模型 SOTA;Coding 能力开源 SOTA 并支持 100 万无损上下文。配套多模态编程模型 GLM-5V-Turbo、Agent 基座 GLM-5-Turbo 与 AutoGLM。(官网新闻页未标注各模型精确发布日期。)
旗舰模型 GLM-5.2 上线并开源 官网当前主力 新模型
GLM-5.2 为智谱新一代旗舰模型,已开源;在 Artificial Analysis 综合榜单取得 51 分,与 Anthropic、OpenAI 一起位居前三,为开源模型 SOTA。Coding 能力开源 SOTA,支持 100 万(1M)无损上下文,长程任务执行更稳定、工程规范遵循更可靠。
查看原文 →
多模态编程模型 GLM-5V-Turbo 官网当前主力 多模态
GLM-5V-Turbo 是原生融合视觉与文本能力的多模态 Coding 模型,针对视觉编程与 Agent 类任务专项优化,定位为迈向原生多模态的 Agent 基座。
查看原文 →
Agent 基座 GLM-5-Turbo 与 AutoGLM 官网当前主力 功能
GLM-5-Turbo 为专门场景打造的基座模型,从训练层深度优化 Agent 核心能力,大幅提升工具调用与长链路执行;AutoGLM 具备自主规划、推理与执行能力,可持续自我改进。
查看原文 →
智谱港股上市(02513.HK),发布首份业绩安排 公司动态 融资
智谱(香港联交所代码 02513.HK)已完成港股上市,并公布 2025 年度业绩发布安排;官网 MaaS 平台持续以高性价比全模态大模型 API 对外服务。
查看原文 →
数据源:https://www.zhipuai.cn/news
通义 Qwen
中国 · 开源 / API
4 项更新
以 GitHub / DashScope 可核实数据为准:Qwen 当前 LLM 旗舰系列为 Qwen3.6(官方 Qwen3.6 仓库,商用线 qwen3.6-max / plus / flash),开源主力为 Qwen3.5 系列(最大旗舰 Qwen3.5-397B-A17B MoE)。近月密集开源:Qwen3-ASR 语音识别、Qwen-AgentWorld 语言世界模型、Qwen3-VL-Embedding。注:官网 qwen.ai 为动态渲染,此前报告出现的「Qwen3.7-Max」在本次全部抓取源中均无佐证,故本期予以更正。
Qwen3.6 大模型系列(商用 Max / Plus / Flash) 旗舰 LLM 系列 新模型
GitHub 官方 Qwen3.6 仓库确认 Qwen3.6 为通义千问当前大语言模型旗舰系列(仓库描述:Qwen3.6 is the large language model series developed by Qwen);官网元数据可见商用三档 qwen3.6-max / qwen3.6-plus / qwen3.6-flash。因官网为 JS 动态页,本次未能抓取到 Qwen3.6 各档位精确上下文长度与定价,谨以模型名为准。
查看原文 →
开源语音识别系列 Qwen3-ASR 2026-06-26 开源
QwenLM 开源 Qwen3-ASR 语音识别模型系列(GitHub 仓库近 30 天更新,星标约 3.0K),配套 Qwen3-ForcedAligner 强制对齐模型,面向多语种高精度语音转写场景。
查看原文 →
语言世界模型 Qwen-AgentWorld 发布 2026-06-25 Agent
QwenLM 发布 Qwen-AgentWorld(Language World Models for General Agents),面向通用智能体的语言世界模型,用于让 Agent 在语言层面建模与预测环境状态;同期还开源 Qwen3-VL-Embedding 多模态向量模型。
查看原文 →
开源系列更新至 Qwen3.5(旗舰 397B-A17B MoE) 开源主力 开源
据阿里云百炼 / DashScope 模型清单,Qwen3.5 开源系列覆盖从 0.8B 到旗舰 Qwen3.5-397B-A17B(MoE,激活约 17B)的完整梯度,含 122B-A10B、35B-A3B、27B、9B、4B、2B 等档位,并提供 FP8 / GPTQ-Int4 量化版本。此外 qwen-code 开源编程 Agent(星标约 25.7K)今日仍在活跃更新。
查看原文 →
数据源:https://qwen.ai/blog
Kimi 月之暗面
中国 · API
2 项更新
月之暗面 Kimi 开放平台当前头条为 Kimi K2.7 Code——官方称其为 Kimi 当前最强 Coding 模型,高速版已同步上线并配合限时促销;主力多模态模型 Kimi K2.6 支持文本 / 图片 / 视频输入,上下文长度 256K。
发布最强 Coding 模型 Kimi K2.7 Code 平台当前头条 新模型
Kimi K2.7 Code 已正式发布,官方定位为 Kimi 当前最强 Coding 模型,高速版本同步上线,平台正进行限时促销活动。面向代码生成与工程编辑等高强度编程场景。
查看原文 →
多模态主力 Kimi K2.6,支持 256K 上下文 2026-04-20 多模态
Kimi K2.6 是月之暗面最新最智能的模型,具备更强更稳的长程代码编写能力,同时支持文本、图片与视频输入,上下文长度达 256K,适合长文档与多模态协同任务。
查看原文 →
数据源:https://www.moonshot.cn/
豆包 / 字节 Seed
中国 · 开源 / API
3 项更新
字节跳动 Seed 团队技术博客近期以 6 月 23 日发布的 Seed2.1(主题「深入 AI 生产力」)为最新一条;配套 Seedance 2.0 视频生成、Seedream 5.0 Lite 图像模型,以及此前的 Seed3D 2.0 与全双工语音大模型。
Seed2.1 正式发布,深入 AI 生产力 2026-06-23 新模型
字节跳动 Seed 团队于 6 月 23 日正式发布 Seed2.1,主题聚焦「深入 AI 生产力」,为团队博客近 30 天内的最新一条模型发布;官网模型成果区同时列有 Seedance 2.0(视频)与 Seedream 5.0 Lite(图像)。
查看原文 →
Seed3D 2.0 发布,3D 生成精度提升 2026-04-23 新模型
Seed3D 2.0 主打更高精度与更强可用性的 3D 生成能力,面向 3D 内容创作与数字资产生产场景。
查看原文 →
Seed 全双工语音大模型发布 2026-04-09 语音
Seed 全双工语音大模型主打「懂倾听、抗干扰」,支持更自然的实时语音交互,走向更接近真人对话节奏的语音体验。
查看原文 →
数据源:https://team.doubao.com/zh/blog
文心一言 / 百度
中国 · 开源 / 闭源 API
1 项更新
本次抓取中,百度千帆 / 文心官网与 yiyan.baidu.com 均为 JS 动态渲染,正文仅返回导航骨架,未能提取到闭源文心旗舰的最新公告。可核实的是 GitHub 上开源的 ERNIE-4.5 系列(覆盖 300B-A47B MoE 至 0.3B)。闭源千帆旗舰的最新动态本期未能抓取确认,故不臆测版本号,谨以开源侧可验证信息为准。
开源 ERNIE-4.5 系列(300B-A47B MoE ~ 0.3B) 开源系列 开源
PaddlePaddle/ERNIE 官方仓库确认开源 ERNIE-4.5 系列,含旗舰 ERNIE-4.5-300B-A47B(MoE,激活约 47B)、ERNIE-4.5-21B-A3B(含 Thinking 推理版)、ERNIE-4.5-VL 多模态版及 0.3B 轻量版,提供 Base 与 Paddle 权重。(注:文心闭源千帆旗舰的最新动态因官网动态渲染,本次未能抓取核实。)
查看原文 →
数据源:https://cloud.baidu.com/doc/WENXINWORKSHOP/index.html
⚠️ 说明
本报告由 Baby Q 自动抓取整理,内容仅供参考。新模型/API/价格变更以厂商官方公告为准。报告每日 10:00(北京时间)自动更新。