报告生成时间 · 2026-06-13 10:08:00 (Asia/Shanghai)
报告日期
2026-06-13
覆盖厂商
9
新增更新
38
生成时间
2026-06-13 10:08:00 (Asia/Shanghai)
快速跳转
OpenAI · 5 Anthropic Claude · 5 Claude Code (CLI) · 4 DeepSeek 深度求索 · 4 智谱 GLM (Z.ai) · 4 通义 Qwen (阿里) · 3 Kimi 月之暗面 · 3 豆包 / 字节 Seed · 5 文心一言 / 百度 · 5
OpenAI
美国 · 闭源 API · ChatGPT
5 项更新
本期重点是 6 月初的 Responses API 增强与平台细则调整:Web 搜索新增图片返回,按分钟计费的容器会话上线,Moderation 已可与 Responses 同步评分;同时官方公告了 Evals 平台、Reusable Prompt 对象与 Agent Builder 的弃用计划。
Responses API Web 搜索新增图片结果 2026-06-09 功能
Responses API 的 web_search 工具现在可以同步返回与文本结果配套的图片结果,适用于需要现网视觉素材的应用场景(产品图、地标、活动现场、视觉参考等)。新能力直接通过 Responses 端点暴露,不需要切换到额外的 image-search 工具。
查看原文 →
Moderation 评分集成进 Responses / Chat Completions 2026-06-04 安全
在生成请求中传入 moderation 对象后,omni-moderation-latest 会同时对模型输入和生成输出进行评分,并在同一次响应里返回 moderation 结果,省去单独再调一次 /v1/moderations 的往返延迟,适合需要在线风控的对话和 RAG 场景。
查看原文 →
弃用 Reusable Prompt / Evals 平台 / Agent Builder 2026-06-03 弃用
OpenAI 公告了三项重大弃用:Reusable Prompt 对象、Evals 平台与 Agent Builder 将分阶段下线,详细时间表和迁移指南发布在 Deprecations 页面。开发者需要尽快迁移到 Responses API + Skills + AgentKit 的新组合。
查看原文 →
容器会话改为按分钟计费(5 分钟起步) 2026-06-02 价格
自 6 月 2 日起,符合条件的 hosted container session 从原先的「按 20 分钟整段计费」改为按分钟计费、5 分钟起步,单价不变。短任务(如一次性代码解释、文件处理)的实际单价会显著下降。
查看原文 →
OpenAI 模型登陆 Amazon Bedrock 2026-06-01 生态
GPT-5.4 / GPT-5.5 等通过一个 OpenAI 兼容的 Responses API 端点在 Amazon Bedrock 上线,并由 AWS 计费。支持的模型与功能因 AWS Region 而异,是 OpenAI 首次官方进入 Bedrock 多云分发。
查看原文 →
数据源:https://platform.openai.com/docs/changelog
Anthropic Claude
美国 · 闭源 API · Claude
5 项更新
Anthropic 在 6 月迎来密集发布:Claude Fable 5 / Mythos 5 作为新一代旗舰模型上线(其中 Mythos 5 因美国政府出口管制临时停服),同时启动 Claude Corps 国家奖学金、推进 Project Glasswing 扩面,并向 SEC 秘密递交 S-1 准备 IPO。
美国政府指令暂停 Fable 5 / Mythos 5 访问 2026-06-12 合规
美国政府针对 Claude Fable 5 与 Claude Mythos 5 发出出口管制指令,Anthropic 已暂停两款模型的对外访问。这是 Anthropic 旗舰模型首次被列入出口管制范围,对依赖该两款模型的海外用户影响最大。
查看原文 →
推出 Claude Corps 国家奖学金计划 2026-06-11 公司
Anthropic 发起 Claude Corps,面向美国各地处于职业生涯早期、热衷于把 AI 红利扩展到更多社区的人才。Anthropic 同期还与 DXC、TCS 等系统集成商达成合作,把 Claude 带入金融、航空等强监管行业。
查看原文 →
发布 Claude Fable 5 与 Mythos 5 2026-06-09 新模型
Fable 5 (claude-fable-5) 为最强广泛发布模型,Mythos 5 (claude-mythos-5) 仅向 Project Glasswing 参与方开放。两款模型默认 1M token 上下文、128k 最大输出、内置常开 adaptive thinking。采用 Opus 4.7 新分词器,同样的文本 token 数比旧版多约 30%,调用前需用 token counting API 重新估算。
查看原文 →
向 SEC 秘密递交 S-1 草案 2026-06-01 融资
Anthropic 公告已向美国 SEC 秘密提交 S-1 草案,启动 IPO 程序。Anthropic 也同步公布了 Anthropic Public Record 的首批结果,进一步增强信息透明度。
查看原文 →
Claude Opus 4.8 上线 2026-05-28 新模型
Claude Opus 4.8 (claude-opus-4-8) 成为目前通用可用的最强模型,默认 1M 上下文(Microsoft Foundry 上为 200k)、128k 输出,新支持 mid-conversation system messages(用户回合后插入 system 消息也能保留 prompt cache 命中),refusal 响应新增公开的 stop_details.category 字段。
查看原文 →
数据源:https://www.anthropic.com/news
Claude Code (CLI)
美国 · 编程 Agent · CLI/IDE
4 项更新
Claude Code 本期密集小版本迭代(2.1.172 → 2.1.176),核心是配合 Fable 5 / Opus 4.8 上线的兼容性修复、availableModels 白名单的强化、以及背景 agent / Remote Control / 沙箱稳定性大量修复。
v2.1.176:Fable 5 自动模式回退 + 多语言会话标题 2026-06-12 版本
会话标题改为按当前对话语言生成,可用 language 设置固定语言;新增 footerLinksRegexes 自定义页脚徽章;修复 availableModels 白名单可被 ANTHROPIC_DEFAULT_*_MODEL 绕过的漏洞;修复未开 Opus 4.8 的组织下 Fable 5 自动模式失败问题,会回退到可用的最佳 Opus 模型。
查看原文 →
v2.1.175:enforceAvailableModels 托管策略 2026-06-10 企业
新增 enforceAvailableModels 托管设置:启用后 availableModels 白名单也约束 Default 模型,Default 若指向被禁的模型,会回退到白名单中首个允许的模型;用户/项目层级的设置不能再放宽托管层的白名单。
查看原文 →
v2.1.174:/model 选择器修复 + 滚轮加速开关 2026-06-08 体验
/model 选择器现在会展示 Default 实际指向的模型家族(Opus / Sonnet);修复 ANTHROPIC_DEFAULT_SONNET_MODEL 自定义后选择器仍显示硬编码 Sonnet 版本号的问题;新增 wheelScrollAccelerationEnabled 控制全屏模式下的鼠标滚轮加速;VSCode 端 /usage 加入按 skill/agent/plugin/MCP 维度的用量归因。
查看原文 →
v2.1.172:子 agent 可再起子 agent(最多 5 层) 2026-06-05 功能
Sub-agent 现在最多可以再向下嵌套 5 层;Bedrock 在没设 AWS_REGION 时会从 ~/.aws 读取区域,匹配 AWS SDK 优先级;在 /plugin 浏览插件市场时新增搜索框;修复了无 usage credit 的 1M context 会话被永久卡死的问题(现会自动 compact 回标准上下文)。
查看原文 →
数据源:https://github.com/anthropics/claude-code/blob/main/CHANGELOG.md
DeepSeek 深度求索
中国 · 开源/API · 杭州
4 项更新
本期 DeepSeek 没有 6 月内的新发布,主线仍是 4 月 24 日发布的 DeepSeek-V4 预览版(V4-Pro / V4-Flash),1M 上下文成为所有官方服务的默认配置,并已被百度千帆等多家平台集成。
DeepSeek-V4 预览版发布,1M 上下文普惠 2026-04-24 新模型
DeepSeek-V4 预览版正式上线并开源,按规模分为 V4-Pro 与 V4-Flash。V4 引入 token 维度压缩 + DSA 稀疏注意力 (DeepSeek Sparse Attention),将 1M 上下文设为所有官方服务的默认配置。V4-Pro 在 Agentic Coding 评测中达到开源 SOTA,内部使用体验优于 Sonnet 4.5,接近 Opus 4.6 非思考模式。
查看原文 →
API 价格调整:V4-Flash 缓存命中 0.02 元 / 百万 tokens 2026-04-24 价格
V4-Flash 输入价 0.02 元(缓存命中)/ 1 元(未命中)、输出 2 元 / 百万 tokens,并发上限 2500;V4-Pro 对应 0.025/3/6 元、并发 500。base_url 不变,只需把 model 改为 deepseek-v4-pro 或 deepseek-v4-flash,同时支持 OpenAI ChatCompletions 与 Anthropic 接口格式。
查看原文 →
deepseek-chat / deepseek-reasoner 旧名 2026-07-24 下线 2026-04-24 弃用
旧有 API 模型名 deepseek-chat 与 deepseek-reasoner 将于 2026 年 7 月 24 日 23:59 停用,目前两者分别指向 V4-Flash 的非思考与思考模式,过渡期 3 个月。建议尽快迁移到 v4-pro / v4-flash 的显式命名。
查看原文 →
V4 开源权重与技术报告 2026-04-24 开源
V4-Pro 与 V4-Flash 权重发布在 HuggingFace 与 ModelScope,技术报告 PDF 同步开源;针对 Claude Code、OpenClaw、OpenCode、CodeBuddy 等主流 Agent 框架做了适配。复杂 Agent 场景建议开启 thinking 模式并将 reasoning_effort 设为 max。
查看原文 →
数据源:https://api-docs.deepseek.com/zh-cn/news/news260424
智谱 GLM (Z.ai)
中国 · 上市 · 北京
4 项更新
智谱 (港股 02513) 主线产品是 GLM-5 系列:GLM-5 在 SWE-bench Verified、Terminal Bench 2.0 等智能体编程榜单达到开源 SOTA、对标 Claude Opus 4.5;GLM-5-Turbo 面向 AutoClaw 等 Agent 场景;GLM-4.6V 是全球 100B 级开源视觉推理模型;本期重要公司动态是首份港股业绩报告与 2025 年度业绩发布安排。
GLM-5:开源编程模型对标 Claude Opus 4.5 2026-06-01 新模型
GLM-5 是智谱面向智能体工程的旗舰基座模型,在 SWE-bench Verified、Terminal Bench 2.0 等智能体编程核心榜单上达到开源模型 SOTA,公开对标 Claude Opus 4.5。可在 BigModel MaaS 上调用,支持工具调用与长链路执行。
查看原文 →
GLM-5-Turbo:专为 AutoClaw 场景打造 2026-06-01 新模型
GLM-5-Turbo 是为「龙虾」AutoClaw 等 Agent 场景定制的基座模型,从训练层深度优化 Agent 核心能力,大幅提升工具调用与长链路执行能力,主打高性价比的高并发智能体推理服务。
查看原文 →
GLM-4.6V:100B 级开源视觉推理 SOTA 2026-06-01 新模型
GLM-4.6V 是全球 100B 级开源视觉推理模型代表,视觉理解精度达同规模 SOTA,原生支持工具调用,可自动完成任务,支持 128K 长上下文,已开放 API 与开源权重。
查看原文 →
智谱首份港股年报:2025 年度业绩发布会安排 2026-05-15 公司
智谱(02513.HK)公告将于 2026 年 3 月 31 日发布截至 2025 年 12 月 31 日的全年业绩,并随后发布了首份港股业绩报告,对外披露 AGI 投入与商业化进展,是中国大模型独角兽 IPO 后的首次完整财年披露。
查看原文 →
数据源:https://www.zhipuai.cn/news
通义 Qwen (阿里)
中国 · 开源/API · 阿里云
3 项更新
近 30 天通义没有新的旗舰模型发布;最新动作集中在 2026 年初的 Qwen3-VL-Flash 上架百炼、万相 Wan2.6 系列发布,以及持续在 Chatbot Arena 等榜单霸榜。Qwen3-Max / Qwen3-VL / Qwen3-Omni 仍是当前主力。
Qwen3-VL-Flash 上架阿里云百炼 2026-01-12 新模型
Qwen3-VL-Flash 是 Qwen3 系列小尺寸视觉理解模型,融合思考与非思考两种模式,效果优于开源版 Qwen3-VL-30B-A3B,响应速度更快。全面升级图像/视频理解,支持长视频、长文档等超长上下文,具备视觉 2D/3D 定位能力。模型评测上 Qwen3-VL-Flash 已超过上一代 Qwen2.5-VL-72B。
查看原文 →
Wan2.6 系列正式发布:国内首个视频角色扮演 2026-01-04 新模型
通义万相 Wan2.6 系列发布,涵盖文生视频、图生视频、参考生视频、图像生成、文生图共 5 大模型。亮点:角色扮演(任意人/物作为主演)、智能分镜叙事(一句话生成多镜头连贯视频)、15s 长视频生成、自然音画同步、音频驱动多镜头演绎。是国内首个支持视频角色扮演功能的模型。
查看原文 →
Qwen3-Max 持续在 Chatbot Arena 榜单霸榜 2025-12-26 榜单
Qwen3-VL 在 9 月底的 Chatbot Arena Vision Arena 子榜单位居第二,是视觉理解领域的全球开源冠军;同时在纯文本赛道 Text Arena 拿到开源第一(全球第 8);在 OpenRouter 图像处理榜单以 48% 市场份额跃升至全球第一。Qwen3-Max 仍是通义当前的旗舰文本模型。
查看原文 →
数据源:https://tongyi.aliyun.com/
Kimi 月之暗面
中国 · 闭源/部分开源 · 北京
3 项更新
Kimi 当前主力是刚发布的 K2.7 Code(最强 Coding 模型)与 K2.6(原生多模态、256K 上下文)。K2.7 Code 在 platform.moonshot.cn 文档首页作为顶部 banner 推送,是本期最重要的更新。
Kimi K2.7 Code:当前最强 Coding 模型发布 2026-06-05 新模型
Kimi K2.7 Code 模型正式发布,被官方定位为「Kimi 当前最强 Coding 模型」,在 platform.moonshot.cn 顶部 banner 显著推广,并在文档首页提供专门的快速上手指南。同时配套限时促销活动。
查看原文 →
Kimi K2.6:原生多模态 + 256K 上下文 2026-04-20 新模型
Kimi K2.6 是月之暗面最新最智能的旗舰模型,具备更强更稳的长程代码编写能力,原生支持文本、图片、视频输入,上下文长度 256K,目前 kimi.com 网站、APP、桌面端与 Chrome 插件全面同步该模型。
查看原文 →
Agent Swarm:Kimi 智能体集群 2026-02-09 功能
Kimi 上线 Agent Swarm(智能体集群),多个 Kimi Agent 协作完成深度研究、一键建站、智能制表、PPT 自主编辑等复杂任务,与原有的 Kimi Agent、Deep Research、Slides、Sheets 等产品形成完整的 Agent 产品线。
查看原文 →
数据源:https://platform.kimi.com/blog
豆包 / 字节 Seed
中国 · 闭源 · 字节跳动
5 项更新
Seed 团队近期主线集中在多模态:4 月发布 Seed3D 2.0 高精度 3D 模型与 Seed 全双工语音大模型;2 月密集发布 Seed2.0 旗舰、Seedream 5.0 Lite 图像、Seedance 2.0 视频生成模型。
Seed3D 2.0 发布:更高精度、更强可用性 2026-04-23 新模型
Seed3D 2.0 是字节 Seed 团队最新一代 3D 生成模型,相比 1.x 版本在几何精度、纹理质量、跨域泛化方面都有显著提升,定位是可直接用于游戏/影视/电商场景的工业级 3D 资产生成。
查看原文 →
Seed 全双工语音大模型:懂倾听、抗干扰 2026-04-09 新模型
Seed 全双工语音大模型支持真正的边听边说交互,能在用户打断、背景噪声中保持稳定对话状态,是走向「更自然、更类人」语音交互的关键一步,对应豆包 APP 与火山方舟语音工具调用的核心升级。
查看原文 →
Seed2.0 正式发布 2026-02-14 新模型
Seed2.0 作为字节内部新一代基础语言模型上线,将作为豆包系列产品(豆包 APP、扣子 / Coze、火山方舟 API)的底层底座,对应豆包模型家族的代际升级。
查看原文 →
Seedream 5.0 Lite:思考更深,生成更准 2026-02-13 新模型
Seedream 5.0 Lite 是 Seedream 5.0 系列的轻量版本,主打更深的思考链与更高的指令遵循准确性,覆盖移动端/边缘端推理场景,是字节图像生成在 ControlNet 时代后的关键迭代。
查看原文 →
Seedance 2.0 正式发布 2026-02-12 新模型
Seedance 2.0 是字节最新一代视频生成模型,在火山方舟提供专门的「Doubao Seedance 2.0 系列教程」和提示词指南,配套 Seedream 4.0-5.0 → Seedance 的视频生成最佳实践,是国内对标 Sora-2 的核心产品。
查看原文 →
数据源:https://team.doubao.com/zh/blog
文心一言 / 百度
中国 · 闭源/部分开源 · 百度智能云
5 项更新
百度千帆当前主推 ERNIE 5.0 原生全模态大模型、ERNIE 5.0-Thinking-Preview 深度推理模型、ERNIE X1.1 Preview,并把 ERNIE 4.5 系列开源(含 ERNIE-4.5-VL-28B-A3B 多模态 MoE);同时千帆平台已上线 DeepSeek-V4 预览版 API 服务。
ERNIE 5.0 原生全模态大模型 2026-05-20 新模型
文心 5.0 (ernie-5.0) 是百度新一代原生全模态大模型,基础能力全面升级,在多模态理解、指令遵循、创意写作、事实性、智能体规划与工具应用等表现尤其出色。上下文 119k(64k 输入),输入价格 0.006-0.01 元/千 tokens,输出价格 0.024-0.04 元/千 tokens,已在千帆控制台开放在线体验。
查看原文 →
ERNIE 5.0-Thinking-Preview:深度推理 + 视觉理解 2026-05-20 新模型
ernie-5.0-thinking-preview 是文心 5.0 系列的深度推理预览版,强化多模态深度推理与视觉理解,价格区间与 5.0 一致:输入 0.006-0.01 元、输出 0.024-0.04 元/千 tokens,上下文 119k(64k 输入)。
查看原文 →
ERNIE-4.5-VL-28B-A3B 开源多模态 MoE 2026-05-01 开源
文心 4.5 中的多模态开源模型 ERNIE-4.5-VL-28B-A3B 采用 MoE 架构,总参数 280 亿、激活参数 30 亿,支持思考与非思考两种模式切换。上下文 32K(30K+8K),千帆 API 输入价格 0.001 元、输出 0.01 元/千 tokens,是国内同尺寸开源多模态的高性价比代表。
查看原文 →
千帆上线 DeepSeek-V4 预览版 API 2026-05-01 生态
百度千帆平台已在首页 banner 推送「百度千帆提供 DeepSeek-V4 预览版 API 服务」,企业可在千帆控制台直接调用 DeepSeek-V4,将其与文心系列、DeepSeek-V3.1-Think 等模型混合编排到同一个 Agent 工作流中。
查看原文 →
ERNIE X1.1 Preview 深度推理预览版 2026-04-15 新模型
ERNIE X1.1 Preview 是百度 X 系列推理模型的最新预览版本,与 ERNIE 4.5 Turbo 一起被千帆首页列为「高效价比的模型服务」首推选项,主打企业级 Agent 场景下的低成本深度推理。
查看原文 →
数据源:https://cloud.baidu.com/product-s/qianfan_home
⚠️ 说明
本报告由 Baby Q 自动抓取整理,内容仅供参考。新模型/API/价格变更以厂商官方公告为准。报告每日 10:00(北京时间)自动更新。