报告生成时间 · 2026-06-11 10:08:15 (Asia/Shanghai)
报告日期
2026-06-11
覆盖厂商
9
新增更新
37
生成时间
2026-06-11 10:08:15 (Asia/Shanghai)
快速跳转
OpenAI · 5 Anthropic Claude · 5 Claude Code (CLI) · 4 DeepSeek 深度求索 · 4 智谱 GLM · 4 通义 Qwen · 4 Kimi 月之暗面 · 4 豆包 / 字节 Seed · 4 文心一言 / 百度 · 3
OpenAI
美国 · 闭源 API · ChatGPT / Codex
5 项更新
近 30 天 OpenAI 主线动态密集:6 月上旬 Web Search 新增图像搜索结果、Moderation API 接入 Responses,并宣布 Evals/Agent Builder/可复用 Prompt 对象进入弃用期;5 月发布 GPT-Realtime-2、Workload Identity Federation、Secure MCP Tunnel 等多项企业能力。
Web Search 新增图像结果 2026-06-09 功能
v1/responses 的 Web Search 工具现在可以同时返回常规文本结果与图像结果。适用于产品图、地标、活动等需要最新视觉素材的场景,开发者可在请求中选择启用图像搜索,详细参数见 Web Search 指南。
查看原文 →
Moderation 分数接入 Responses API / Chat Completions 2026-06-04 API
在 v1/responses 与 v1/chat/completions 请求中传入 moderation 对象,即可在同一次响应里同时拿到模型输入和生成输出的 omni-moderation-latest 分数。这显著简化了内容安全审查管线,无需额外调用一次审核端点。
查看原文 →
宣布弃用可复用 Prompt 对象、Evals 平台与 Agent Builder 2026-06-03 弃用
OpenAI 在 6 月 3 日 changelog 中明确公告:reusable prompt 对象、Evals 平台以及 Agent Builder 都将进入弃用流程,具体下线时间和迁移路径写在 deprecations 页面。开发者需要尽快迁移到 Responses API 原生 prompt 管理与新版评估栈。
查看原文 →
Container 会话改为分钟级计费 2026-06-02 价格
自 2026 年 6 月 2 日起,符合条件的 container 会话(Code Interpreter 等内置工具)改为按分钟计费、最低 5 分钟,不再按 20 分钟整段计费。每分钟单价不变,但对短任务而言实际成本将显著下降,详情见 API pricing 文档。
查看原文 →
GPT-5.4 / GPT-5.5 上架 Amazon Bedrock 2026-06-01 新模型
OpenAI 模型现在可以通过兼容 Responses API 的端点在 Amazon Bedrock 上调用,首批覆盖 gpt-5.4 与 gpt-5.5。支持的模型与功能因 AWS Region 而异,企业可在不离开 AWS 账号体系的情况下使用 OpenAI 顶级模型。
查看原文 →
数据源:https://platform.openai.com/docs/changelog
Anthropic Claude
美国 · 闭源 API · Claude / Claude Code
5 项更新
Anthropic 6 月节奏激进:发布 Mythos 级新一代模型 Claude Fable 5 与 Claude Mythos 5,扩展 Project Glasswing 至 150+ 组织、推出 Claude Partner Network 服务分级,并在 5 月底完成 650 亿美元 H 轮融资及 Opus 4.8 升级。
发布 Claude Fable 5 与 Claude Mythos 5 2026-06-09 新模型
Fable 5 是面向通用使用的 Mythos 级新一代模型,软件工程、知识工作、视觉与科学研究等多项基准为当前 SOTA,Stripe 实测可把数月的工程压缩到数日;Mythos 5 是同底座但解除部分安全限制的版本,初期通过 Project Glasswing 开放给可信网络安全合作伙伴。两款模型价格均为 10 美元/百万输入 token、50 美元/百万输出 token,不到 Mythos Preview 的一半。
查看原文 →
推出 Claude Partner Network 服务分级与 Partner Hub 2026-06-03 生态
新的 Services Track 把合作伙伴分为 Select / Preferred / Global Premier 三档,门槛分别为 10/100/1000 名活跃认证人员、2/15/100 个生产案例、1/3/15 个公开客户案例。Accenture、Cognizant、Deloitte、KPMG、Infosys、PwC 等大型咨询都已围绕 Claude 建立专门实践,Anthropic 已为该计划承诺 1 亿美元投入。
查看原文 →
Project Glasswing 扩展至 150+ 组织 2026-06-02 安全
继 4 月首批 ~50 家合作伙伴累计发现超过 10,000 个高/极高危漏洞后,Project Glasswing 把 Mythos Preview 的访问权扩展到 15+ 国家、150 多个新组织,新增电力、水务、医疗、通信、硬件等关键基础设施厂商及开源核心维护者,目标是把强大的网络安全能力让防御方先用上。
查看原文 →
Anthropic 向 SEC 秘密递交 S-1 招股书 2026-06-01 公司
Anthropic 在 6 月 1 日宣布已向美国 SEC 秘密递交 S-1 草案,启动正式 IPO 流程,紧随其 5 月底完成的 650 亿美元 H 轮(投后估值 9650 亿美元)。这是迄今规模最大的 AI 实验室上市筹备动作之一。
查看原文 →
发布 Claude Opus 4.8 2026-05-28 新模型
Opus 4.8 是 Opus 系列的升级版,在编程、Agentic 任务与专业工作上的性能和长程任务稳定性显著提升,并搭配同日发布的 650 亿美元 Series H 融资公告(投后估值 9650 亿美元)共同登场。系统提示词、模型卡与新版定价同步发布。
查看原文 →
数据源:https://www.anthropic.com/news
Claude Code (CLI)
美国 · CLI 工具 · Anthropic
4 项更新
Claude Code 6 月主线迭代到 2.1.172,重点是子代理嵌套(最深 5 层)与 Fable 5 模型接入(2.1.170),同时大规模修 bug 与体验优化。
v2.1.172:子代理嵌套至 5 层 + 长上下文会话自愈 2026-06-09 功能
Sub-agents 现在可以再派生自己的 sub-agents,最深可达 5 层;1M context 但无 usage credits 的会话不再永久卡住,会自动 compact 回标准上下文长度。Bedrock 接入按 AWS SDK 顺序读取 ~/.aws 区域,/plugin 浏览支持搜索栏,并修复了多个 availableModels / agents 显示问题。
查看原文 →
v2.1.170:接入 Claude Fable 5 2026-06-09 新模型
随 Anthropic 主线发布的 Claude Fable 5(Mythos 级且面向通用使用)一同上线,更新到 2.1.170 即可使用。同时修复了从 VS Code 集成终端启动会话不保存 transcripts、不出现在 --resume 列表里的问题。
查看原文 →
v2.1.169:新增 --safe-mode、/cd 命令、post-session hook 2026-06-05 功能
新增 --safe-mode/CLAUDE_CODE_SAFE_MODE 一键禁用全部自定义(CLAUDE.md、plugins、skills、hooks、MCP servers)用于排障;新增 /cd 命令可在不破坏 prompt cache 的情况下切换工作目录;自建 runner 增加 post-session 生命周期 hook 用于备份未提交变更。
查看原文 →
v2.1.166:fallbackModel 与跨会话消息硬化 2026-05-30 功能
新增 fallbackModel 设置,最多可串联 3 个备用模型用于主模型过载/不可用时自动回退;通过 SendMessage 中继的跨会话消息不再携带用户权限,接收方会拒绝转发权限请求,auto mode 直接阻断;deny rule 工具名位置支持 glob 模式("*" 拒绝全部工具)。
查看原文 →
数据源:https://github.com/anthropics/claude-code/blob/main/CHANGELOG.md
DeepSeek 深度求索
中国 · 开源 + API · 杭州深度求索
4 项更新
DeepSeek 近期最大动作是 DeepSeek-V4 预览版发布,在网页端、APP 和 API 同步上线;新一代模型对外提供 deepseek-v4-pro 与 deepseek-v4-flash 两档,原 deepseek-chat/reasoner 将于 7/24 弃用。
DeepSeek-V4 预览版发布 2026-06-01 新模型
首页大字宣告:DeepSeek-V4 预览版本已发布,具备世界顶级推理性能,Agent 能力大幅提升,并在网页端、APP 和 API 同时上线。V4 系列分为 deepseek-v4-pro(旗舰)与 deepseek-v4-flash(高吞吐)两个型号,均支持思考/非思考双模式。
查看原文 →
V4 API 上线:1M 上下文 + Anthropic 兼容端点 2026-06-01 API
新 API 同时提供 OpenAI 兼容地址 https://api.deepseek.com 与 Anthropic 兼容地址 https://api.deepseek.com/anthropic。模型支持 1M 上下文、最大 384K 输出,可通过 reasoning_effort 与 thinking 参数控制思考模式,并已被 Claude Code、GitHub Copilot、OpenCode 等主流 Agent 工具接入。
查看原文 →
新版定价:百万 token 输出最低 2 元 2026-06-01 价格
deepseek-v4-flash:输入 1 元/M(缓存未命中)/ 0.02 元/M(缓存命中)/ 输出 2 元/M,并发限制 2500;deepseek-v4-pro:输入 3 元/M / 0.025 元/M / 输出 6 元/M,并发 500。对比同档国际旗舰模型仍是激进定价。
查看原文 →
deepseek-chat / deepseek-reasoner 模型名将于 7/24 弃用 2026-06-01 弃用
为兼容老用户,deepseek-chat 与 deepseek-reasoner 两个模型名将于北京时间 2026/07/24 23:59 弃用,二者将分别对应 deepseek-v4-flash 的非思考与思考模式。建议在弃用前完成 SDK / 模型名迁移。
查看原文 →
数据源:https://www.deepseek.com/
智谱 GLM
中国 · 闭源 + 开源 · 智谱华章 (02513.HK)
4 项更新
智谱主线已迈入 GLM-5 / GLM-5.1 时代:GLM-5 旗舰基座对齐 Claude Opus 4.5,并已在阿里云百炼以 glm-5.1 形式上架。GLM-4.6V 等视觉/多模态线持续迭代,AutoClaw、AutoGLM 等 Agent 产品矩阵不断扩张。
GLM-5 基座模型登顶开源 Agentic Engineering SOTA 2026-06-01 新模型
GLM-5 面向 Agentic Engineering 打造,参数规模 744B(激活 40B),预训练数据 28.5T,集成 DeepSeek Sparse Attention 和全新 Slime 异步强化学习框架;SWE-bench-Verified 77.8 分、Terminal Bench 2.0 56.2 分均为开源最高,编程实测体感对齐 Claude Opus 4.5,上下文 200K,最大输出 128K。
查看原文 →
GLM-5 Turbo / GLM-4.6V / AutoGLM 全栈矩阵 2026-06-01 产品
首页公布全栈模型矩阵:GLM-5-Turbo 针对 Agent 场景深度优化工具调用与长链路执行;GLM-4.6V 是全球 100B 级开源视觉推理模型,原生支持工具调用、128K 上下文;AutoGLM 是具备自主规划/推理/执行能力的智能体模型,新一代 AutoClaw 一键给电脑装上「小龙虾」桌面 Agent。
查看原文 →
glm-5.1 上架阿里云百炼,与 Qwen / DeepSeek 同台 2026-05-15 生态
在阿里云百炼 Model Studio 三方模型清单中,glm-5.1 已正式上线,与 deepseek-v4-pro/flash、kimi-k2.6、MiniMax-M2.7 等并列为可直接调用的三方文本模型,开发者无需在多个 SaaS 平台间切换。
查看原文 →
智谱 2025 年度业绩报告发布 2026-03-31 公司
智谱(港股代码 02513.HK)发布 2025 年度业绩报告,作为国内首家上市的纯大模型厂商,正式向资本市场披露年度财务和 AGI 探索进展。
查看原文 →
数据源:https://www.zhipuai.cn/
通义 Qwen
中国 · 开源 + API · 阿里巴巴
4 项更新
Qwen 体系已升级到 qwen3.7 系列(max/plus/flash)并通过阿里云百炼对外服务;图像生成线推出 wan2.7-image-pro 与 qwen-image-2.0-pro,全模态线由 qwen3.5-omni-plus 提供,百炼平台 2026 年 1-2 月持续完善知识库、长期记忆与智能体应用 2.0。
千问模型矩阵升级到 qwen3.7-max / plus / qwen3.6-flash 2026-05-30 新模型
阿里云百炼模型大全显示,文本生成线主推 qwen3.7-max(最强)、qwen3.7-plus(性价比)、qwen3.6-flash(低成本高速),并把视觉、全模态、语音等能力统一到 qwen3.5-omni-plus / qwen3.5-omni-plus-realtime 上,支持端到端语音对话不再单独调用 ASR / TTS。
查看原文 →
图像/视频生成线:wan2.7-image-pro 与 qwen-image-2.0-pro 2026-05-30 新模型
图像生成主推 wan2.7-image-pro 与 qwen-image-2.0-pro;视频生成新增 happyhorse-1.0 系列(t2v/i2v/r2v/video-edit),3D 生成接入 Tripo-H3.1/P1.0,音乐生成由 fun-music-v1 提供,构成完整多模态生成栈。
查看原文 →
百炼知识库支持订阅计费资源包 2026-02-10 功能
百炼知识库新增订阅计费资源包(RAG 标准版 / 旗舰版),与原有按量付费并列,企业可一次性买断更经济的 RAG 容量,详情见知识库计费说明。
查看原文 →
Agent 2.0:智能体应用新版上线 2025-12-26 产品
新版智能体应用(Agent 2.0)把知识库、MCP 工具统一为「工具」,由智能体自主规划调用顺序,并完整展示模型思考与工具调用过程,是百炼平台向 Agentic 平台演进的关键一步。
查看原文 →
数据源:https://qwen.ai/
Kimi 月之暗面
中国 · 闭源 + 开源 · 北京月之暗面
4 项更新
Kimi 主线产品已是 Kimi K2.6(原生多模态、超强代码与 Agent 性能、256K 上下文),并保留 K2 Thinking 等深度推理变体。开放平台过去几个月围绕 K2 高速版、K2 Turbo 价格调整与 Agent Swarm 持续迭代。
发布 Kimi K2.6 旗舰多模态模型 2026-04-20 新模型
Kimi K2.6 是 Moonshot 最新最智能的模型,具备更强更稳的长程代码编写能力,原生支持文本、图片与视频输入,上下文长度 256K。官方主推为新一代旗舰,与 Agent Swarm、WorldVQA 等研究方向共同构成 K2 系列的主线。
查看原文 →
Agent Swarm:多智能体集群能力发布 2026-02-09 研究
Moonshot 研究团队发布 Agent Swarm 工作,对应平台侧新增的 Agent / Agent 集群产品,支持把复杂任务拆解到多个智能体并行协作。
查看原文 →
WorldVQA:世界模型级视觉问答研究 2026-02-03 研究
WorldVQA 是 Moonshot 在世界模型与多模态视觉理解方向的最新研究成果,与 K2.6 的多模态能力相互验证。
查看原文 →
Kimi K2 Thinking 模型发布并开源 2025-11-07 新模型
K2 Thinking 在 Agent 和推理能力上做了深度强化,发布同时开源权重,与稍后发布的 K2.6 共同构成 Kimi 在思考型与多模态型两条产品线。开放平台对应价格调整通知与 K2 Turbo 5 折特惠也在同期发布。
查看原文 →
数据源:https://www.moonshot.cn/
豆包 / 字节 Seed
中国 · 闭源 API · 字节跳动 · 火山方舟
4 项更新
字节 Seed 团队 2026 上半年完整发布了 Seed2.0 基座、Seedance 2.0 视频生成、Seedream 5.0 Lite 图像生成、Seeduplex 全双工语音、Seed3D 2.0 等一整套新模型,火山方舟模型列表 5/29 同步更新到对应版本。
Seed3D 2.0 发布:更高精度、更强可用性 2026-04-23 新模型
Seed3D 2.0 在 Seed3D 1.0 基础上构建了完整的 simulation-ready 3D 内容生成体系,包含场景布局规划、part-aware 网格生成等模块,与五款最新商业模型的对比研究显示其胜率稳定领先。
查看原文 →
Seeduplex 全双工语音大模型发布 2026-04-09 新模型
Seeduplex 是 Seed 团队首个全双工语音大模型,专门优化「懂倾听、抗干扰」能力,把人机语音交互从单工对讲推进到更自然的双向对话体验。
查看原文 →
Seed2.0 正式发布 2026-02-14 新模型
Seed2.0 是字节 Seed 团队 2026 年的新一代基座,配合稍早发布的 Seedance 2.0 视频生成、Seedream 5.0 Lite 图像生成共同构成多模态全栈矩阵。火山方舟模型列表 2026.05.29 同步更新到对应版本。
查看原文 →
Seedream 5.0 Lite 发布:思考更深、生成更准 2026-02-13 新模型
Seedream 5.0 Lite 在图像生成上进一步增强 prompt 理解和细节生成,火山方舟提供 Seedream 4.0-5.0 系列教程与提示词指南。同期发布的 Seedance 2.0 视频生成模型也已通过方舟开放调用。
查看原文 →
数据源:https://team.doubao.com/zh/blog
文心一言 / 百度
中国 · 闭源 API · 百度智能云千帆
3 项更新
百度智能云今年最热门的两条线是「文心 5.0 上线百度千帆」与「文心快码 / Zulu 编程助手」生态扩张,但官方文档没有公开的 changelog 页可抓,仅能从百度智能云新闻列表与文心 4.5 API 实操等公开文章侧面验证。
文心 5.0 正式上线百度千帆 2026-05-25 新模型
百度智能云新闻热门栏目首条为「正式发布!文心 5.0 上线百度千帆 手机也能用 OpenClaw 了!」,配合千帆大模型平台上的文心 5.0 接入与 OpenClaw 移动端体验同步上线,但官方暂未公开详细技术参数与定价 changelog。
查看原文 →
文心快码 Rules 与 Zulu Agent 实战指南 2026-05-10 产品
千帆开发者社区热门文章包括「生产力 UP!文心快码 Rules 功能实战指南」「用文心快码 Zulu 打造太阳系 3D 模拟器」等,显示百度在 IDE 编程助手方向持续强化文心快码 + Zulu Agent 双产品。
查看原文 →
文心 4.5 API 零基础调用手册 2026-05-01 教程
百度智能云持续推广文心 4.5 API(零基础调用手册),意味着 4.x 系列仍是当前可稳定商用的主力模型,5.0 处于上线/灰度并存阶段。
查看原文 →
数据源:https://cloud.baidu.com/doc/WENXINWORKSHOP/index.html
⚠️ 说明
本报告由 Baby Q 自动抓取整理,内容仅供参考。新模型/API/价格变更以厂商官方公告为准。报告每日 10:00(北京时间)自动更新。