报告生成时间 · 2026-06-06 10:05:00 (Asia/Shanghai)
报告日期
2026-06-06
覆盖厂商
9
新增更新
38
生成时间
2026-06-06 10:05:00 (Asia/Shanghai)
快速跳转
OpenAI · 5 Anthropic Claude · 5 Claude Code (CLI) · 4 DeepSeek 深度求索 · 3 智谱 GLM · 5 通义 Qwen · 5 Kimi 月之暗面 · 3 豆包 / 字节 Seed · 4 文心一言 / 百度 · 4
OpenAI
美国 · 闭源 API · ChatGPT
5 项更新
近一周持续在企业级与运营层面加码:Responses API 新增审核打分、容器计费改按分钟、模型登陆 AWS Bedrock;同时正式宣布关停 Evals 平台与 Agent Builder。GPT-5.5(旗舰)已稳定运营约 6 周。
Responses API 与 Chat Completions API 新增审核分数返回 2026-06-04 API/安全
在生成请求中传入 moderation 对象,即可在同一响应里同时拿到模型输入与生成输出的内容审核结果,基于 omni-moderation-latest 模型。该能力面向 Responses API 与 Chat Completions API,便于开发者把内容安全检查整合进单次请求,无需额外往返调用。
查看原文 →
宣布弃用 Reusable Prompts、Evals 平台与 Agent Builder 2026-06-03 弃用通知
OpenAI 官方宣布三项产品进入弃用流程:可复用 Prompt 对象、Evals 评测平台以及 Agent Builder 工具。具体下线时间和迁移指南已发布于 deprecations 页面,开发者需尽快迁移到 Responses API 内置工具与第三方 Eval 框架。
查看原文 →
容器会话计费改为按分钟、5 分钟起步 2026-06-02 价格
自 6 月 2 日起,符合条件的 container session 改为按分钟计费(最低 5 分钟),不再按 20 分钟整段计费。底层每分钟单价不变,本质上是给短会话调用降价,让用 Hosted Container 跑短任务更划算。
查看原文 →
GPT-5.5 / GPT-5.4 登陆 Amazon Bedrock(兼容 Responses API) 2026-06-01 API/合作
OpenAI 模型首次以 OpenAI 兼容的 Responses API 形式在 AWS Bedrock 上线,支持 GPT-5.5 与 GPT-5.4。具体支持的模型和能力按 AWS Region 不同而有差异,意味着 OpenAI 在打破对 Azure 的独家依赖。
查看原文 →
GPT-5.5 与 GPT-5.5 Pro 旗舰发布,1M 上下文 2026-04-24 新模型
GPT-5.5 作为面向复杂专业工作的新旗舰发布到 Chat Completions 与 Responses API;GPT-5.5 Pro 则只在 Responses API 提供,用于需要更多算力的高难度任务。支持 1M token 上下文、图像输入、结构化输出、Batch、Tool Search、内置 Computer Use、Hosted Shell、Apply Patch、Skills、MCP、Web Search;推理力度默认 medium,仅支持 extended prompt caching。
查看原文 →
数据源:https://platform.openai.com/docs/changelog
Anthropic Claude
美国 · 闭源 API · Claude
5 项更新
近一周是 Anthropic 的高强度公司事件周:Claude Opus 4.8 旗舰升级、宣布完成 650 亿美元 H 轮、向 SEC 秘密递交 S-1 准备 IPO,并扩大 Project Glasswing 安全联盟到 150 个组织。
推出 Claude 合作伙伴网络的 Services Track 和 Partner Hub 2026-06-03 生态
Anthropic 在合作伙伴网络中新增 Services Track(服务集成商赛道)和 Partner Hub(合作门户),把咨询、实施类伙伴纳入正式分层管理,配套门户提供资源、培训和共同上市工具,明显是为企业市场放量做铺垫。
查看原文 →
Project Glasswing 扩展至 15+ 国家约 150 家组织 2026-06-02 安全
今年 4 月与 AWS、Apple、Google、Microsoft、NVIDIA、Cisco、Linux Foundation、JPMorgan 等共同启动的关键软件安全联盟 Project Glasswing 再次扩容,引入更多国家与组织共建关键软件供应链与漏洞响应基础设施。
查看原文 →
向 SEC 秘密递交 S-1 草案,正式启动 IPO 进程 2026-06-01 公司动态
Anthropic 已向美国证券交易委员会秘密提交 S-1 草案文件,进入 IPO 准备阶段。结合上周公布的 650 亿美元 H 轮和 9650 亿美元投后估值,公司正在以闪电速度推进资本路径。
查看原文 →
完成 650 亿美元 H 轮融资,投后估值 9650 亿美元 2026-05-28 融资
Anthropic 宣布完成 H 轮融资 650 亿美元,投后估值达到 9650 亿美元,跻身全球估值最高的 AI 创业公司前列。本轮融资为后续模型训练算力扩张、企业市场拓展以及 IPO 路演提供子弹。
查看原文 →
Claude Opus 4.8 旗舰发布 2026-05-28 新模型
Opus 类模型的进阶升级,在编码、Agent 任务和专业工作场景中表现更强,同时拥有处理长程任务所需的稳定一致性。结合此前 Claude Sonnet 4.6(2026-02-17)、Opus 4.6(2026-02-05),Opus 4.8 取代 Opus 4.7 成为新一代旗舰,主打长程稳定与编码/智能体能力。
查看原文 →
数据源:https://www.anthropic.com/news
Claude Code (CLI)
美国 · 命令行编码助手 · Anthropic 出品
4 项更新
保持高频小版本迭代,过去 30 天连发 2.1.160 → 2.1.167 多个版本,重点是新增 fallbackModel 配置、托管设置策略加强、cross-session 消息安全收紧,以及大量后台 Agent / 多终端兼容性修复。
v2.1.166:新增 fallbackModel 配置和 deny rule 通配符 2026-05-30 功能
新增 fallbackModel 设置,可配置最多三个回退模型,当主模型过载或不可用时按顺序尝试;--fallback-model 也对交互式会话生效。Deny rule 的工具名位置新增 glob 通配符支持(如 * 拒绝所有工具)。强化跨会话消息安全:通过 SendMessage 中继的消息不再携带用户权限,auto mode 会直接拒绝来自其他会话的中继权限请求。
查看原文 →
v2.1.163:新增 requiredMinimumVersion 托管策略与 /plugin list 命令 2026-05-28 企业
新增 requiredMinimumVersion / requiredMaximumVersion 托管设置,Claude Code 在版本超出范围时拒绝启动并提示批准版本,为企业版本治理打底。新增 /plugin list 命令枚举已装插件,支持 --enabled / --disabled 过滤;/btw 加入 c-to-copy 快捷键复制原始 markdown 答案。
查看原文 →
v2.1.162:claude agents 增强可观测性与可用性 2026-05-25 Agent
claude agents --json 现在包含 waitingFor 字段,可看出会话被什么阻塞(如权限提示)。--tools 显式列出 Grep / Glob 现在能在原生构建里启用专用搜索工具;/effort 会确认所选默认推理力度是否持久化。修复 stream-json/SDK 会话中 Esc 中断在 turn 起始处被静默丢弃的问题。
查看原文 →
v2.1.160:写入 shell 启动文件前增加确认提示 2026-05-22 安全
对 .zshenv / .zlogin / .bash_login 和 ~/.config/git/ 等写入操作新增写前提示,防止意外的命令执行。acceptEdits 模式现在写入 .npmrc / .yarnrc / bunfig.toml / .bazelrc / .pre-commit-config.yaml / .devcontainer 等可能赋予执行权限的构建工具配置文件前也会要求确认。Edit 不再需要 grep 之后再单独 Read。
查看原文 →
数据源:https://raw.githubusercontent.com/anthropics/claude-code/main/CHANGELOG.md
DeepSeek 深度求索
中国 · 开源 + API · 杭州
3 项更新
近期最大动作是 4 月 24 日发布 DeepSeek-V4 预览版,把 1M 上下文做成所有官方服务标配,并把 V4-Pro / V4-Flash 同步开源。旧模型名 deepseek-chat / deepseek-reasoner 将在 7 月 24 日停服。
DeepSeek-V4 预览版发布:1M 上下文普惠,开源 + API 同步上线 2026-04-24 新模型
全新 V4 系列发布并开源,分 V4-Pro 与 V4-Flash 两档:前者性能比肩顶级闭源模型,Agentic Coding 已达开源 SOTA、内部反馈使用体验优于 Sonnet 4.5、接近 Opus 4.6 非思考模式;V4-Flash 推理力接近 Pro 但更便宜。两版均默认 1M 上下文、最大输出 384K、同时支持思考与非思考模式。
查看原文 →
V4 API 价格定档:Pro 输出 6 元/M token、Flash 输出 2 元/M token 2026-04-24 价格
V4-Flash 单价:缓存命中输入 0.02 元/M token、缓存未命中输入 1 元/M token、输出 2 元/M token;V4-Pro:缓存命中输入 0.025 元、未命中 3 元、输出 6 元/M token。并发限制 V4-Flash 2500、V4-Pro 500。base_url 不变,model 参数改为 deepseek-v4-pro 或 deepseek-v4-flash 即可调用。
查看原文 →
deepseek-chat / deepseek-reasoner 将于 2026-07-24 停服 2026-04-24 弃用通知
旧有 API 模型名 deepseek-chat 与 deepseek-reasoner 将于 2026 年 7 月 24 日停止使用。当前阶段两者分别指向 deepseek-v4-flash 的非思考与思考模式。用户需在 7 月前迁移到新 model 参数 deepseek-v4-pro / deepseek-v4-flash。
查看原文 →
数据源:https://api-docs.deepseek.com/zh-cn/news/news
智谱 GLM
中国 · 开源 + API · 北京(02513.HK)
5 项更新
近期主推 GLM-5 系列升级与 Z.ai 品牌焕新:GLM-5-Turbo 主打 Agent 场景、GLM-4.6V 开源视觉推理、AutoGLM 智能体;并于 4 月发布首款桌面 Agent 产品 AutoClaw。智谱已在港交所上市(02513.HK)。
GLM-5-Turbo:为 Agent 与小龙虾场景深度优化的基座 2026-05 新模型
GLM-5-Turbo 是从训练层为小龙虾(AutoClaw / GLM-OS 桌面 Agent)场景深度优化的基座模型,大幅提升工具调用与长链路执行能力,作为 Agent 形态的底座模型,可承接 50 步以上自主操作。
查看原文 →
GLM-5 在 SWE-bench Verified / Terminal Bench 2.0 上达到开源 SOTA 2026-05 新模型
智谱面向智能体工程推出的旗舰基座 GLM-5,在 SWE-bench Verified、Terminal Bench 2.0 等智能体编程核心榜单上达到开源模型 SOTA,官方宣称比肩 Claude Opus 4.5,是当前开源阵营在 agentic coding 上最具竞争力的中文起家模型之一。
查看原文 →
GLM-4.6V:100B 级开源视觉推理模型 2026-05 新模型
全球 100B 级中效果表现出众的开源视觉推理模型,视觉理解精度达同规模 SOTA,原生支持工具调用,可端到端完成任务,支持 128K 长上下文,已通过 MaaS 平台提供 API 服务。
查看原文 →
GLM-5 / GLM-5.1 通过阿里云百炼第三方直供 2026-05-19 渠道
智谱直供的 glm-5、glm-5.1 模型在 2026-05-19 上线阿里云百炼平台(型号 ZHIPU/GLM-5、ZHIPU/GLM-5.1),适用于智能交互、企业应用及开发辅助等场景,意味着智谱进一步加大三方云市场覆盖。
查看原文 →
智谱(02513.HK)发布首份业绩报告 2026 公司动态
智谱作为港股上市公司发布首份业绩报告,并预告将于 2026 年 3 月 31 日公布截至 2025-12-31 止年度业绩,是国内首批走完独立 IPO 路径的大模型公司之一。
查看原文 →
数据源:https://www.zhipuai.cn/news
通义 Qwen
中国 · 开源 + API · 阿里云
5 项更新
百炼平台 5-6 月密集上新:Qwen 3.7 Plus(多模态混合智能体)、Qwen 3.7 Max(纯文本旗舰)、Qwen 3.5 LiveTranslate(60 种语言实时音视频翻译),并大量引入第三方直供模型(DeepSeek、阶跃、智谱、小米 MiMo、HappyHorse、Vidu、Tripo 等)。
qwen3.7-plus 上线:多模态混合智能体能力 2026-06-01 新模型
千问 3.7 Plus 系列推理模型上线百炼,在强文本能力基础上全面升级视觉-语言能力,同时保持编码、工具使用与生产力工作流的完整智能体能力。核心特色是多模态交互混合智能体能力:能感知真实场景、读取屏幕并操作 GUI、基于视觉参考生成代码、端到端导航移动应用。
查看原文 →
qwen3.7-max 旗舰发布(仅文本,默认思考模式) 2026-05-21 新模型
Qwen Max 系列新一代旗舰模型上线(qwen3.7-max、qwen3.7-max-2026-05-20)。仅支持纯文本输入,默认开启思考模式,支持显式缓存,在编程、办公与生产力、长周期自主执行方面均能出色胜任各项任务,目标是补齐 Max 档位对标 GPT-5 / Opus 旗舰。同时另发预览版 qwen3.7-max-preview。
查看原文 →
qwen3.5-livetranslate-flash-realtime:60 种语言实时音视频翻译 2026-05-19 新模型
一款多语言音视频实时翻译模型,可识别 60 种语言,并实时翻译为 29 种语言的音频输出,面向直播、跨语种会议、字幕生成等实时场景,是阿里在 Qwen-MT 多语种系列上的下一步落地。
查看原文 →
百炼平台引入小米 MiMo-V2.5-Pro / 阶跃 Step 3.7 Flash 等第三方直供 2026-05-19 生态
百炼在 5 月 19 日同日上线多家第三方直供模型:小米 MiMo-V2.5-Pro(通用智能体能力、复杂软件工程、长程任务)、阶跃星辰 Step 3.7 Flash(搜索、Agent、编码、多模态四方向升级)、智谱 GLM-5/5.1。平台向多家厂商开放,强化阿里云的中立 MaaS 定位。
查看原文 →
DeepSeek-V4-Pro 缓存命中价调整为 1 元/百万 token 2026-04-29 价格
百炼平台上 deepseek-v4-pro 模型 cached_token 单价调整为 1 元/百万 token,标准 input_token 单价不变。其余同期还引入 HappyHorse 文生/图生/参考生/视频编辑、Vidu Q3 全系列参考生视频、Tripo H3.1 / P1.0 3D 生成模型等。
查看原文 →
数据源:https://help.aliyun.com/zh/model-studio/product-overview/notice
Kimi 月之暗面
中国 · 开源 + API · 月之暗面 Moonshot AI
3 项更新
Kimi K2.6 已正式上线(kimi.com / App / API / Kimi Code),主打长程代码编写与 Agent Swarm 大规模并行。开放平台同时提供 K2.6 / K2.5 / Moonshot V1 三档模型,K2.6 输出价 ¥27/M token、K2.5 输出价 ¥21/M token。
Kimi K2.6 发布:长程编码与 Agent Swarm 全面升级 2026-04-20 新模型
Kimi K2.6 在长程编码任务中实现显著提升,跨编程语言(Rust / Go / Python)、跨任务(前端 / DevOps / 性能优化)泛化稳定。Agent Swarm 架构横向扩展到 300 个子 Agent、4000 步并行执行(K2.5 上限为 100 子 Agent、1500 步),同时新增 Claw Groups 研究预览,支持跨设备、跨模型的智能体协作。
查看原文 →
Kimi K2.6 多项榜单逼近 GPT-5.4 / Claude Opus 4.6 2026-04-20 性能
K2.6 在 HLE-Full (with tools) 取得 54.0(GPT-5.4 52.1、Opus 4.6 53.0、Gemini 3.1 Pro 51.4),DeepSearchQA f1 92.5、BrowseComp 83.2,并在 Toolathlon、OSWorld-Verified 上达到开源 SOTA。K2.6 还演示了 4000 工具调用 + 12 小时连续执行实例(Mac 上本地部署 Qwen3.5-0.8B 并优化推理)。
查看原文 →
API 价格:K2.6 输入 ¥6.50 / 输出 ¥27、缓存 ¥1.10 每百万 token 2026-04-20 价格
Kimi 开放平台公布 K2.6 API 价格:缓存命中 ¥1.10/M token、输入 ¥6.50/M token、输出 ¥27.00/M token;K2.5 缓存 ¥0.70 / 输入 ¥4.00 / 输出 ¥21.00;Moonshot V1(131k 上下文)输入 ¥10 / 输出 ¥30。同时官方工具集(Web Search / Rethink / Memory / Excel / Code-Runner / QuickJS / Fetch 等)开箱即用。
查看原文 →
数据源:https://www.moonshot.cn/
豆包 / 字节 Seed
中国 · 自研 + 火山方舟 API · 字节跳动
4 项更新
Seed 团队近期更聚焦多模态与机器人方向:4 月发布 Seed3D 2.0(3D 生成)和 Seed 全双工语音大模型;2 月密集发布 Seed2.0 主模型、Seedream 5.0 Lite、Seedance 2.0;底层 Keel 架构论文给出 1000+ 层 Transformer 训练方案。
Seed3D 2.0 发布:3D 生成几何与纹理双 SOTA 2026-04-23 新模型
Seed3D 2.0 是基于 Seed3D 1.0 的升级版高保真 3D 内容生成系统,在几何上采用 coarse-to-fine 两阶段管线,纹理与材质改用统一 PBR 模型一次性生成多视角 albedo 与 metallic-roughness 图。在人类偏好评测中相对五款近期商业模型取得 69.0%-89.9% 的胜率,覆盖单物体、场景布局、部件级铰接生成等仿真就绪场景。
查看原文 →
Seed 全双工语音大模型发布 2026-04-09 新模型
Seeduplex 全双工语音大模型发布,主打懂倾听、抗干扰,把语音交互从轮流式 push-to-talk 推向更自然的人类对话节奏,瞄准客服、外呼、AI 陪伴、AI 眼镜等实时语音场景。
查看原文 →
Seed2.0 正式发布 2026-02-14 新模型
字节 Seed 系列的主线基座 Seed2.0 正式发布,配套 Seedream 5.0 Lite(图像生成)、Seedance 2.0(视频生成)同期上线火山方舟,覆盖文本、视觉、视频三大方向,作为豆包 / 火山引擎背后的统一模型层。
查看原文 →
Keel 架构论文:Post-LayerNorm 复活,可稳定训练 1000+ 层 2026-01-30 研究
Seed 提出 Keel —— 将 Post-LN Transformer 残差路径改造为 Highway-style 连接,解决了原始 Post-LN 在大模型上的梯度消失问题。Keel 无需特殊初始化即可在超过 1000 层的深度上稳定训练,相比 Pre-LN 在 perplexity 与深度扩展性上持续改善,为 infinite-depth 架构铺路。
查看原文 →
数据源:https://team.doubao.com/zh/blog
文心一言 / 百度
中国 · 闭源 + 部分开源 · 百度智能云千帆
4 项更新
近一个月主线是 ERNIE 5.1 正式发布并在多榜单登顶,5.1-Preview 登顶 LMArena 中文 Text Arena、全球 13 名;同时千帆平台上线 DeepSeek-V4 Preview API,并把 ERNIE-5.0-thinking-preview / 4.5 Turbo 与 DeepSeek 系列并列推荐。
ERNIE 5.1 正式发布:仅用 6% 预训练成本实现全面升级 2026-05-09 新模型
ERNIE 5.1 正式发布,宣称仅以可比模型 6% 的预训练成本就在多榜单登顶。采用 disaggregated fully-asynchronous reinforcement learning(解耦全异步强化学习)与规模化 agentic post-training,在 Agent、推理、创意写作方向全面升级,在 Arena Search Arena 中文榜单排名第一。
查看原文 →
ERNIE-5.1-Preview 登顶 LMArena 中文 Text、全球 #13 2026-04-30 榜单
4 月 30 日 LMArena 最新榜单显示 ERNIE-5.1-Preview 在 LMArena Text Arena 中文模型排名第一、全球排名第 13 位,多个垂类子榜进入全球前 10。这是百度文心系列在国际盲测榜单上的最新一次站位。
查看原文 →
ERNIE-Image 发布:8B DiT 文生图基础模型 2026-04-15 新模型
ERNIE-Image 是基于单流 Diffusion Transformer 架构的文生图模型,DiT 参数 8B,在 open-weights 模型中达到领先水平。补齐文心系列在原生图像生成方向的开源基模空缺,配合 ERNIE 5.x 文本主模型构成多模态产品矩阵。
查看原文 →
百度千帆同步上线 DeepSeek-V4 Preview API 服务 2026 渠道
百度智能云千帆平台首页广告位明确标出「百度千帆提供 DeepSeek-V4 预览版 API 服务」,并把 ernie-5.0-thinking-preview / ERNIE X1.1 Preview / ERNIE 4.5 Turbo / DeepSeek-V3.1-Think / DeepSeek-V3.1 同列推荐。ERNIE-5.0 上下文 119k/64k,输入价 0.006-0.01 元/千 token、输出价 0.024-0.04 元/千 token。
查看原文 →
数据源:https://yiyan.baidu.com/blog/
⚠️ 说明
本报告由 Baby Q 自动抓取整理,内容仅供参考。新模型/API/价格变更以厂商官方公告为准。报告每日 10:00(北京时间)自动更新。