报告生成时间 · 2026-06-14 10:08:00 (Asia/Shanghai)
报告日期
2026-06-14
覆盖厂商
9
新增更新
37
生成时间
2026-06-14 10:08:00 (Asia/Shanghai)
快速跳转
OpenAI · 5 Anthropic Claude · 5 Claude Code (CLI) · 4 DeepSeek 深度求索 · 3 智谱 GLM · 4 通义 Qwen / 千问 · 3 Kimi / 月之暗面 · 4 豆包 / 字节 Seed · 5 文心一言 / 百度 · 4
OpenAI
美国 · 闭源 API · ChatGPT
5 项更新
六月 OpenAI 主要在围绕 GPT-5.5 / GPT-5.4 做生态扩散:Bedrock 上线 OpenAI-Compatible Responses 端点,Web Search 工具新增图片结果,Moderation 分数被并入主 Responses / Chat Completions 调用,同时宣布了 Reusable Prompts、Evals 平台和 Agent Builder 三项产品的废弃时间表。
Web Search 工具支持返回图片结果 2026-06-09 功能
v1/responses 中的 Web Search 工具现在可以在文本结果之外,同时返回图片搜索结果。适用于需要实时或带网络背景视觉资料的场景,如商品照、地标、活动现场和视觉参考。详见 Web Search 工具指南。
查看原文 →
Responses API / Chat Completions 内联 Moderation 分数 2026-06-04 API
Responses API 和 Chat Completions API 新增 moderation 字段,在生成请求中传入 moderation 对象即可在同一次响应中收到针对输入与输出的审核结果,省去额外调用 omni-moderation-latest 的开销。审核模型仍为 omni-moderation-latest。
查看原文 →
宣布 Reusable Prompts、Evals 平台、Agent Builder 三项产品废弃 2026-06-03 废弃
OpenAI 在 Deprecations 页正式宣布了 Reusable prompt objects、Evals 平台、Agent Builder 三项产品的下线时间表与迁移方案,建议正在依赖这三个产品的客户尽快查阅 deprecations 文档并安排迁移。
查看原文 →
容器会话改为按分钟计费(5 分钟起步) 2026-06-02 价格
自 2026 年 6 月 2 日起,符合条件的容器会话由原先按整 20 分钟计费改为按分钟计费、5 分钟起步价;单位时间费率保持不变。短会话场景下实际成本下降,长会话不受影响。
查看原文 →
GPT-5.4 / GPT-5.5 上线 Amazon Bedrock 2026-06-01 渠道
OpenAI 模型 GPT-5.4、GPT-5.5 通过兼容 Responses API 的端点登陆 Amazon Bedrock,模型与功能可用性依 AWS 区域而定。AWS 客户首次可不出 VPC 直接调用最新 GPT-5 系列。
查看原文 →
数据源:https://platform.openai.com/docs/changelog
Anthropic Claude
美国 · 闭源 API · 前沿大模型
5 项更新
六月 Anthropic 进入了节奏密集的产品 + 政策窗口期:旗舰 Claude Fable 5 / Mythos 5 上线(默认 1M 上下文 + always-on Adaptive Thinking),但仅 3 天后即被美国政府 export control 指令暂停访问;同期机密递交 S-1 启动 IPO,并与 TCS、DXC 等系统集成商建立金融与监管行业合作。
美国政府暂停 Fable 5 / Mythos 5 的访问 2026-06-12 重大公司动态
美国政府向 Anthropic 下达出口管制指令,要求暂停对 Claude Fable 5 与 Claude Mythos 5 两个最新旗舰模型的所有访问。Anthropic 当日发声明回应,未透露具体管辖范围与受影响地区。
查看原文 →
推出 Claude Corps 全国 AI Fellowship 2026-06-11 项目
Anthropic 启动 Claude Corps,面向职业早期人才设立全国 fellowship,目标是将 AI 带入更多美国社区。项目侧重把通用 AI 能力落地到公共部门、教育与小微商业场景。
查看原文 →
Claude Fable 5 与 Claude Mythos 5 正式上线 2026-06-09 新模型
Claude Fable 5(claude-fable-5)面向所有客户发布,是 Anthropic 当前能力最强的通用模型;Claude Mythos 5(claude-mythos-5)面向 Project Glasswing 合作伙伴。两款模型默认 1M token 上下文窗口、128K 最大输出、always-on Adaptive Thinking;启用了新版分词器,相同文本约多产生 30% token。Fable 5 还要求 30 天数据留存,不支持零数据留存。
查看原文 →
Anthropic 机密递交 S-1 文件至 SEC 2026-06-01 融资 / 上市
Anthropic 宣布以保密方式向美国证监会(SEC)递交 S-1 注册声明初稿,正式启动 IPO 流程。具体发行规模、时间窗口尚未披露。
查看原文 →
Claude Opus 4.8 发布 2026-05-28 新模型
Claude Opus 4.8(claude-opus-4-8)发布,是 Anthropic 上一代旗舰,默认 1M 上下文(Claude API / Bedrock / Vertex AI;Microsoft Foundry 为 200K)、128K 最大输出,Effort 默认 high;Prompt Caching 最小缓存长度降至 1024 token,比 Opus 4.7 更友好。Adaptive Thinking 仅在需要时触发,降低思考 token 浪费。Computer Use、Task Budgets、Advisor Tool 等新工具同步支持。
查看原文 →
数据源:https://www.anthropic.com/news
Claude Code (CLI)
美国 · CLI · 终端编程 Agent
4 项更新
Claude Code 2.1.x 持续高频小版本迭代,主要围绕 availableModels 强制策略、Fable 5 适配、后台 Agent 稳定性、Remote Control 体验、跨平台沙箱(macOS/Linux/Windows)几条主线在打磨。
会话标题按对话语言生成、Hooks 路径匹配修复 v2.1.176 功能 / 修复
Session 标题现在会以对话所用语言生成(可通过 language 设置固定语言);Bedrock 凭证缓存改为按 Expiration 而非固定 1 小时;availableModels 白名单将不再被 ANTHROPIC_DEFAULT_*_MODEL 环境变量绕过;修复了 Edit(src/**)、Read(~/.ssh/**) 等 hook 条件匹配错误以及 macOS/Linux tmux 下 /copy 不进系统剪贴板的问题。
查看原文 →
enforceAvailableModels 受管理员强制约束 v2.1.175 企业 / 策略
新增 enforceAvailableModels 托管设置,开启后 availableModels 白名单同时约束 Default 模型解析;user / project 配置无法再放宽管理员强制的 availableModels 列表。适合企业受控部署场景。
查看原文 →
/model 选择器修复 + 后台 Agent 凭证隔离 v2.1.174 修复
/model 选择器在 Max / Team Premium / Enterprise 等套餐下正确显示 Opus;后台会话不再继承别的会话的 ANTHROPIC_* 提供商环境变量;GovCloud Bedrock 区域不再被推导为错误的 inference profile;Fable 5 计费横幅在企业用量计费账户上的误报修复。
查看原文 →
Sub-agent 支持嵌套(最多 5 层) v2.1.172 Agent
Sub-agents 现在可以再 spawn 自己的 sub-agents,最深 5 层;Amazon Bedrock 会从 ~/.aws 配置文件读取区域(与 AWS SDK 优先级一致),并在 /status 中显示区域来源;新增 marketplace 插件搜索栏;修复 1M 上下文会话用尽用量额度后被永久卡住的问题(现自动 compact 回标准上下文)。
查看原文 →
数据源:https://raw.githubusercontent.com/anthropics/claude-code/main/CHANGELOG.md
DeepSeek 深度求索
中国 · 开源 · 自研架构
3 项更新
DeepSeek 自 2026-04-24 发布 V4 预览版后近期未出新版本,处于产品消化期。V4 系列把 1M 上下文与百万 token 长记忆作为所有官方服务的标配,V4-Pro 在 Agentic Coding 上据官方评测优于 Sonnet 4.5、接近 Opus 4.6 非思考模式。
DeepSeek-V4 预览版发布,开源 + API 同步上线 2026-04-24 新模型
DeepSeek-V4 预览版发布并开源,分 deepseek-v4-pro 与 deepseek-v4-flash 两档。V4-Pro 在 Agentic Coding 评测中达开源模型最佳水平、世界知识仅次于 Gemini-Pro-3.1;V4-Flash 更小更快,简单 Agent 任务与 Pro 持平。原 deepseek-chat / deepseek-reasoner 模型名将于 2026-07-24 23:59 弃用,过渡期内分别映射 deepseek-v4-flash 的非思考与思考模式。
查看原文 →
DeepSeek 引入全新注意力机制 + DSA 稀疏注意力 2026-04-24 技术
V4 在 token 维度做压缩并结合 DeepSeek Sparse Attention (DSA),实现 1M 长上下文同时大幅降低显存 / 算力需求。1M 上下文已成为 DeepSeek 所有官方服务(chat.deepseek.com、App、API)的标配。
查看原文 →
V4 系列价格 / 并发明细 2026-04-24 价格
deepseek-v4-flash 1M 上下文、最大输出 384K,缓存命中 0.02 元 / M tokens,缓存未命中 1 元,输出 2 元 / M tokens,并发 2500;deepseek-v4-pro 缓存命中 0.025 元,缓存未命中 3 元,输出 6 元 / M tokens,并发 500。两档均支持 JSON Output、Tool Calls、Anthropic 兼容端点。
查看原文 →
数据源:https://api-docs.deepseek.com/zh-cn/updates
智谱 GLM
中国 · 港股上市 · GLM 系列 + AutoGLM
4 项更新
智谱五月密集推出 GLM Coding Plan 团队版(企业自助订阅),并在四月连发 GLM-5.1 旗舰、GLM-5V-Turbo 多模态 Coding 基座、GLM-5-Turbo 龙虾增强基座。GLM-5.1 官方宣称综合能力全面对齐 Claude Opus 4.6,可一次任务持续工作长达 8 小时。
GLM Coding Plan 团队版上线 2026-05-29 产品 / 商业化
面向企业与开发团队推出自助订阅的 GLM Coding Plan 团队版,延续个人版高额模型用量,兼容全球主流编码工具;支持席位、权限、用量与预算统一管理;提供集中账单与企业级数据安全保障(默认不将代码、提示词、对话用于训练);高级版可首发接入最新旗舰模型并享受高峰期资源优先保障。
查看原文 →
GLM-5.1 新一代旗舰模型上线 2026-04-07 新模型
GLM-5.1 Coding 能力大幅增强,长程任务(Long Horizon Task)可在一次任务中独立持续工作长达 8 小时,实现从规划、执行到交付的完整闭环;综合能力全面对齐 Claude Opus 4.6,官方称是首个在综合能力上做到与 Opus 4.6 对齐的中国模型;通过 multi-turn SFT、RL 与过程质量评估体系强化长任务稳定性与 tool use 能力。
查看原文 →
GLM-5V-Turbo 多模态 Coding 基座上线 2026-04-02 新模型
兼顾视觉理解与 Coding,更小参数下取得更好性能;细粒度理解、几何感知、空间理解能力进一步增强;强化 GUI Agent、Coding Agent 等复杂任务;多模态工具链扩展,支持画框、截图、读网页(含图片识别)等多模态 Tools。
查看原文 →
GLM-5-Turbo 龙虾(OpenClaw)增强基座上线 2026-03-15 新模型
面向 OpenClaw 龙虾场景深度优化的基座模型,强化工具与各类 Skills 的调用能力,复杂指令拆解、多智能体协同更稳定;面向大数据吞吐、长逻辑链的龙虾任务进一步提升执行效率与响应稳定性。
查看原文 →
数据源:https://docs.bigmodel.cn/cn/update/new-releases
通义 Qwen / 千问
中国 · 阿里巴巴 · 开源 + 闭源 双轨
3 项更新
千问近 30 天 qwenlm.github.io 与 qwen.ai 官方博客均无新博文(最近一篇为 Qwen3Guard,2025 年 9 月)。研发节奏主要透露在通义实验室与百炼平台的产品更新中:年初的 Qwen3-VL-Flash 与万相 Wan2.6 仍是最新对外产品节点。
Qwen3-VL-Flash 上架百炼 2026-01-12 新模型
Qwen3 系列小尺寸视觉理解模型 Qwen3-VL-Flash 上架阿里百炼控制台,实现思考与非思考模式融合,效果优于开源版 Qwen3-VL-30B-A3B,响应速度更快;全面升级图像 / 视频理解,支持长视频长文档等超长上下文,具备视觉 2D/3D 定位能力。官方评测显示 qwen3-vl-flash 效果超过上一代 qwen2.5-vl-72b。
查看原文 →
万相 Wan2.6 系列正式发布 2026-01-04 视频生成
通义万相 Wan2.6 涵盖文生视频、图生视频、参考生视频、图像生成、文生图五大模型,国内首个支持角色扮演视频生成;新增 15 秒长视频(参考生视频 10s)、多镜头叙事、智能分镜、自然音画同步与多人对话稳定生成能力,面向影视级创作场景升级。
查看原文 →
Qwen3Guard 实时安全护栏模型(仍为博客最新一篇) 2025-09-23 安全
Qwen3Guard 是 Qwen 家族首款安全护栏模型,分 Qwen3Guard-Gen(生成式版,用于离线数据集标注 / RL 奖励信号)与 Qwen3Guard-Stream(流式逐 token 检测)。提供 0.6B / 4B / 8B 三档参数,引入「争议性」第三档风险等级标签,支持 119 种语言。已上线 HuggingFace、ModelScope、阿里云 AI 安全护栏服务。
查看原文 →
数据源:https://qwen.ai/blog
Kimi / 月之暗面
中国 · 长上下文 + 代码 Agent
4 项更新
Kimi 当前最新模型为 Kimi K2.7 Code(API 平台首页主推),定位为月之暗面迄今最强的 Coding 模型;K2.7 Code、K2.6、K2.5 三档均提供 256K 上下文窗口。K2.6 多模态版(2026-04-20)仍为对外主要叙事点,支持文本 / 图片 / 视频输入。
Kimi K2.7 Code 正式发布 2026-Q2 新模型
Kimi K2.7 Code 是月之暗面迄今最智能的 Coding 模型,主打长上下文中更可靠的指令遵循、更高的编程任务成功率,支持文本 / 图片 / 视频输入与思考模式,对话与 Agent 任务通用。注意:K2.7 Code 不支持非思考模式(强制思考)。配套有限时促销活动,并完全兼容 OpenAI SDK。
查看原文 →
K2.7 Code / K2.6 / K2.5 全系统一 256K 上下文 2026-Q2 上下文
kimi-k2.7-code、kimi-k2.6、kimi-k2.5 三档均提供 256K 上下文窗口;面向不同编程语言(Rust、Go、Python)与场景(前端、运维、性能优化)的泛化能力均有突破。Tool Use 参数兼容性、多模态工具调用等已完善文档化。
查看原文 →
Kimi K2.6 多模态对话模型发布 2026-04-20 多模态
Kimi K2.6 是月之暗面最新最智能的通用模型,具备更强更稳的长程代码编写能力,同时支持文本、图片与视频输入,256K 上下文。Kimi 主站与 API 平台首页主推 K2.6,研发博客同步发表 Advancing Open-Source Coding 技术博文。
查看原文 →
Agent Swarm:多 Agent 横向扩展 2026-02-09 Agent
Kimi 研究团队发表 Agent Swarm 技术博文,提出 Scale Out, Not Just Up 思路:用多 Agent 并行协作替代单纯增大单 Agent 能力,作为 Kimi Claw 等 24/7 Agent 产品的底层架构方向。
查看原文 →
数据源:https://platform.kimi.com/docs
豆包 / 字节 Seed
中国 · 字节跳动 · 多模态 + 视频生成
5 项更新
字节 Seed 团队四月主要在做语音与 3D 方向的迭代:Seed 全双工语音大模型与 Seed3D 2.0 接连发布;二月连发 Seed2.0 通用大模型、Seedream 5.0 Lite 图像、Seedance 2.0 视频三件套,构成 Seed 全模态产品矩阵。火山方舟侧持续在 Doubao Seedance 2.0 与 Seedream 4.0-5.0 的教程文档上做完善。
Seed3D 2.0 发布 2026-04-23 新模型 / 3D
字节 Seed 团队发布 Seed3D 2.0,相比 1.x 提供更高精度的 3D 生成能力与更强可用性,是 Seed 在 3D 内容生成方向的最新一代。
查看原文 →
Seed 全双工语音大模型发布 2026-04-09 新模型 / 语音
Seed Full-duplex / Seeduplex 全双工语音大模型发布,主打懂倾听、抗干扰,让语音交互在被打断与背景噪声场景下更自然、更接近真人对话节奏。
查看原文 →
Seed 2.0 通用大模型正式发布 2026-02-14 新模型
Seed2.0 是字节跳动 Seed 团队的新一代通用大模型,是后续 Seedream / Seedance / Seed3D 等多模态家族的基座升级;同周配套发布的 Seedream 5.0 Lite(图像)、Seedance 2.0(视频)共同构成 2026 年初的 Seed 大模型产品节点。
查看原文 →
Seedream 5.0 Lite 发布:「思考」更深、生成更准 2026-02-13 图像生成
Seedream 5.0 Lite 是 Seedream 5.0 系列的轻量版,强调在「思考」深度和生成准确度上的同步提升,已通过火山方舟 Seedream 4.0-5.0 教程接入。
查看原文 →
Doubao Seedance 2.0 视频生成模型上线火山方舟 2026-02-12 视频生成
Doubao Seedance 2.0 系列视频生成模型上线火山方舟,配套提示词指南与教程,覆盖视频生成、图生视频等场景;火山方舟 Responses API 同步支持 Seedance 系列。
查看原文 →
数据源:https://team.doubao.com/zh/blog
文心一言 / 百度
中国 · 百度 · ERNIE 系列 + 千帆
4 项更新
ERNIE 进入 5.1 时代:ERNIE 5.1 正式版以全量训练成本仅为同等模型 6% 的预训练效率刷新「性价比」叙事,并在 LMArena Search Arena 拿到中国第一;同期发布的 ERNIE-Image 是百度在国产芯片上完成全流程训练的 8B DiT 文生图模型;ERNIE 5.0 (2.4T 参数 Unified Multimodal) 仍为底座。
ERNIE 5.1 正式发布,多榜单登顶 2026-05-09 新模型
ERNIE 5.1 正式发布,预训练成本仅为同等模型的 6%,在 LMArena Search Arena 上排名中国第一。底层采用 disaggregated fully-asynchronous reinforcement learning 与 scaled agentic post-training,在 Agent、推理、创意能力上全面升级;官方定位为更懂用户、写作更佳的下一代旗舰模型。
查看原文 →
ERNIE-5.1-Preview 在 LMArena 文本榜单中国第一 2026-04-30 评测
LMArena 2026-04-30 发布最新排行榜,ERNIE-5.1-Preview 在 LMArena Text Arena 上中国第一、全球第 13 名,并在多个类别子榜单中进入全球 Top 10。
查看原文 →
ERNIE-Image 文生图模型发布 2026-04-15 图像生成
ERNIE-Image 是基于 single-stream Diffusion Transformer (DiT) 的文生图模型,DiT 参数 8B,是国内开源权重模型中处于领先水平的文生图模型;作为 ERNIE 多模态家族的图像分支补齐。
查看原文 →
ERNIE 5.0 - 2.4 万亿参数统一多模态基础模型 2026-02-06 新模型
ERNIE 5.0 是 2.4 万亿参数的 Unified Multimodal 模型,从头训练,把文本、图像、视频、音频整合进单一自回归框架,跳过了 late-fusion 架构的局限,实现跨模态无缝理解与生成。是后续 ERNIE-5.1 与 ERNIE-Image 的底座。
查看原文 →
数据源:https://yiyan.baidu.com/blog/
⚠️ 说明
本报告由 Baby Q 自动抓取整理,内容仅供参考。新模型/API/价格变更以厂商官方公告为准。报告每日 10:00(北京时间)自动更新。