报告生成时间 · 2026-06-19 10:08:00 (Asia/Shanghai)
报告日期
2026-06-19
覆盖厂商
9
新增更新
28
生成时间
2026-06-19 10:08:00 (Asia/Shanghai)
快速跳转
OpenAI · 5 Anthropic Claude · 5 Claude Code (CLI) · 3 DeepSeek 深度求索 · 2 智谱 GLM · 3 通义 Qwen / 千问 · 2 Kimi / 月之暗面 · 2 豆包 / 字节 Seed · 3 文心一言 / 百度 · 3
OpenAI
美国 · 闭源 API · ChatGPT
5 项更新
OpenAI 官方 changelog 近 30 天最新条目仍停在 6 月 9 日(Web Search 工具新增图片结果),本周无全新公告;6 月整体围绕 GPT-5.5 生态打磨:Web Search 返回图片、Responses / Chat Completions 内联 Moderation 分数、容器会话改按分钟计费、GPT-5.4 / 5.5 上线 Amazon Bedrock,以及平台导航改版。
Web Search 工具支持返回图片结果 2026-06-09 功能
v1/responses 中的 Web Search 工具现在可在文本结果之外同时返回图片搜索结果,适用于需要实时或带网络背景视觉资料的场景,如商品照、地标、活动现场与视觉参考。这是 OpenAI changelog 近 30 天内最新的一条公告,本周无新增条目。
查看原文 →
OpenAI API 平台导航全面改版 2026-06-05 产品
OpenAI 发布了重新设计的 API 平台导航结构,调整了文档、API 参考、Codex、ChatGPT 等板块的组织方式,以适配日益庞大的产品矩阵,方便开发者更快定位所需文档与工具。
查看原文 →
Responses API / Chat Completions 内联 Moderation 分数 2026-06-04 API
在生成请求中传入 moderation 对象,即可在同一次响应里同时收到针对输入与输出的审核结果,省去额外调用 omni-moderation-latest 的开销。底层审核模型仍为 omni-moderation-latest。
查看原文 →
容器会话改为按分钟计费(5 分钟起步) 2026-06-02 价格
自 2026 年 6 月 2 日起,符合条件的容器会话由原先按整 20 分钟计费改为按分钟计费、5 分钟起步价,单位时间费率保持不变。短会话场景下实际成本下降,长会话不受影响。
查看原文 →
GPT-5.4 / GPT-5.5 上线 Amazon Bedrock 2026-06-01 渠道
OpenAI 模型 GPT-5.4、GPT-5.5 通过兼容 Responses API 的端点登陆 Amazon Bedrock,模型与功能可用性依 AWS 区域而定,AWS 客户首次可不出 VPC 直接调用最新 GPT-5 系列。另:5 月 29 日起未启用 ZDR 的组织 prompt_cache_retention 默认由 in_memory 改为 24h。
查看原文 →
数据源:https://platform.openai.com/docs/changelog
Anthropic Claude
美国 · 闭源 API · 前沿大模型
5 项更新
Anthropic 本周重点转向模型生命周期管理:6 月 15 日正式下线 Claude Sonnet 4 与 Opus 4(建议迁移至 Sonnet 4.6 / Opus 4.8),并升级代码执行与联网工具版本。此前 6 月旗舰 Fable 5 / Mythos 5 上线 3 天即被美国政府出口管制指令暂停访问;公司层面新设首尔办公室、与 TCS / DXC 达成受监管行业合作。
开设首尔办公室,深化与韩国 AI 生态合作 2026-06-17 重大公司动态
Anthropic 宣布在首尔设立办公室,并与韩国 AI 生态多家机构达成新的合作伙伴关系,加速 Claude 在韩国企业与公共部门的落地,是其近期国际化布局的最新一步。
查看原文 →
下线 Claude Sonnet 4 与 Opus 4,建议迁移至 4.6 / 4.8 2026-06-15 废弃
Anthropic 在 Claude Platform 发布说明中宣布退役 Claude Sonnet 4(claude-sonnet-4-20250514)与 Claude Opus 4(claude-opus-4-20250514),所有请求将直接返回错误,建议分别升级至 Claude Sonnet 4.6 与 Claude Opus 4.8;研究者仍可通过 External Researcher Access Program 申请继续访问。
查看原文 →
美国政府暂停 Fable 5 / Mythos 5 的访问 2026-06-12 重大公司动态
美国政府向 Anthropic 下达出口管制指令,要求暂停对 Claude Fable 5 与 Claude Mythos 5 两个最新旗舰模型的所有访问,Anthropic 当日发表声明回应,同日还公布了首份 Anthropic Public Record 的结果。
查看原文 →
代码执行与联网工具升级新版本 2026-06-11 API
Claude Platform 上线 code_execution_20260521,在工具描述中明示单元格 90 秒执行时限,便于 Claude 为长任务做预算;Web Search 与 Web Fetch 工具升级至 web_search_20260318 / web_fetch_20260318,新增 response_inclusion 参数以在 Agent 工作流中丢弃已消费的结果块,两者均无需 beta header。
查看原文 →
Claude Opus 4.8 发布 2026-05-28 新模型
Anthropic 发布 Opus 级别升级模型 Claude Opus 4.8,在编码、Agent 任务与专业工作上的表现更强,并具备处理长时程任务所需的稳定性。该模型也是 6 月 15 日 Opus 4 退役后的官方推荐迁移目标。
查看原文 →
数据源:https://www.anthropic.com/news
Claude Code (CLI)
美国 · CLI · 终端编程 Agent
3 项更新
Claude Code 本周再进一版至 2.1.183(昨日报告为 2.1.181),核心是 auto 模式安全收紧:默认拦截 git reset --hard / git clean -fd 等破坏性命令、未授权的 *.destroy 与非本会话的 commit --amend,并对已废弃 / 自动升级的模型给出警告,同时修复子代理 WebSearch、Windows Terminal TUI 错乱、仅思考块空回复等大量问题。
auto 模式破坏性命令拦截 + 废弃模型告警 v2.1.183 安全 / 功能
auto 模式新增安全护栏:未要求丢弃改动时拦截 git reset --hard、git checkout -- .、git clean -fd、git stash drop,非本会话提交时拦截 git commit --amend,未指定 stack 时拦截 terraform / pulumi / cdk destroy;当请求模型已废弃或被自动升级时在 stderr 给出告警(含 agent frontmatter 指定的模型);新增 attribution.sessionUrl、/config --help。修复子代理 WebSearch 返回空、仅思考块导致空回合、Windows Terminal 嵌套子代理下 TUI 错乱等问题。
查看原文 →
/config 即时配置 + Bun 1.4 + 流式与启动修复 v2.1.181 功能 / 修复
新增 /config key=value 语法(交互、-p、Remote Control 均可用)即时设置任意配置;新增 sandbox.allowAppleEvents、CLAUDE_CLIENT_PRESENCE_FILE 等设置;bundled Bun 运行时升级至 1.4;长段落改为逐行流式输出。修复自定义 ANTHROPIC_BASE_URL / Foundry 下 prompt caching 不读取、网络盘写入 0 字节、多处启动卡顿与崩溃等问题。
查看原文 →
中途断流保留 + WSL2 滚动修复 v2.1.179 修复
修复中途连接断开:部分响应现予以保留而非直接报错,spinner 不再卡在 running tool;修复 WSL2 在 Windows Terminal / VS Code 下鼠标滚轮失效(2.1.172 引入的回归);修复 Linux 上大目录 denyRead/allowRead glob 导致 Bash 工具描述过大使会话卡死。
查看原文 →
数据源:https://raw.githubusercontent.com/anthropics/claude-code/main/CHANGELOG.md
DeepSeek 深度求索
中国 · 开源 · 自研架构
2 项更新
DeepSeek 官方更新日志近 30 天无新公告,最近一次主要更新仍为 2026-04-24 的 V4 预览版。V4 把 1M 上下文与百万 token 长记忆作为所有官方服务标配,V4-Pro 在 Agentic Coding 上据官方评测达开源 SOTA;旧模型名 deepseek-chat / deepseek-reasoner 将于 2026-07-24 弃用。
DeepSeek-V4 预览版发布,开源 + API 同步上线 2026-04-24 新模型
DeepSeek-V4 预览版发布并开源,分 deepseek-v4-pro 与 deepseek-v4-flash 两档。V4-Pro 在 Agentic Coding 评测中达开源模型最佳水平、世界知识仅次于 Gemini-Pro-3.1;V4-Flash 更小更快。原 deepseek-chat / deepseek-reasoner 模型名将于 2026-07-24 弃用,过渡期内分别映射 v4-flash 的非思考与思考模式。
查看原文 →
引入 DSA 稀疏注意力,1M 上下文成官方服务标配 2026-04-24 技术
V4 在 token 维度做压缩并结合 DeepSeek Sparse Attention (DSA),实现 1M 长上下文同时大幅降低显存 / 算力需求。1M 上下文已成为 DeepSeek 所有官方服务(chat.deepseek.com、App、API)的标配。
查看原文 →
数据源:https://api-docs.deepseek.com/zh-cn/updates
智谱 GLM
中国 · 港股上市 · GLM 系列 + AutoGLM
3 项更新
智谱新品发布页最新一条仍为 GLM-5.2(2026-06-16):支持 1M 无损上下文,Coding 与长程任务评测达开源 SOTA,本周无新增公告。GLM 旗舰序列已迭代到 GLM-5 → GLM-5.1 → GLM-5.2,并于 5 月底上线面向企业的 GLM Coding Plan 团队版。
GLM-5.2 新一代旗舰模型上线 2026-06-16 新模型
GLM-5.2 支持 1M 无损上下文,长程任务能力显著提升,减少复杂任务中的上下文漂移与目标遗忘;Coding 与长程任务评测达到开源 SOTA,在复杂系统工程、深度调试中表现更稳;项目级上下文承载、工程规范遵循与多端开发更可靠,真实开发体感显著提升。这是新品发布页近 30 天内最新条目。
查看原文 →
GLM Coding Plan 团队版上线 2026-05-29 产品 / 商业化
面向企业与开发团队的自助订阅方案上线,延续个人版高额模型用量、兼容全球主流编码工具;支持席位、权限、用量与预算统一管理,提供集中账单、统一开票与企业级数据安全保障(默认不将代码、提示词、对话用于训练);高级版可首发接入最新旗舰模型并享高峰期资源优先保障。
查看原文 →
GLM-5.1 新一代旗舰模型上线 2026-04-07 新模型
GLM-5.1 Coding 能力大幅增强,长程任务(Long Horizon Task)支持一次任务中独立持续工作长达 8 小时,实现从规划、执行到交付的完整闭环;综合能力全面对齐 Claude Opus 4.6,官方称是首个在综合能力上做到全面对齐 Opus 4.6 的中国模型。
查看原文 →
数据源:https://docs.bigmodel.cn/cn/update/new-releases
通义 Qwen / 千问
中国 · 阿里巴巴 · 开源 + 闭源 双轨
2 项更新
通义千问近 30 天 qwenlm.github.io 与 qwen.ai 官方博客均无新博文(博客最新一篇仍为 2025-09-23 的 Qwen3Guard)。qwenlm.github.io 现已整体跳转至 qwen.ai,对外最新产品节点仍为年初上架阿里百炼的 Qwen3-VL-Flash 与通义万相 Wan2.6 系列。
Qwen3-VL-Flash 上架百炼 2026-01-12 新模型
Qwen3 系列小尺寸视觉理解模型 Qwen3-VL-Flash 上架阿里百炼控制台,实现思考与非思考模式融合,效果优于开源版 Qwen3-VL-30B-A3B,响应更快;全面升级图像 / 视频理解,支持长视频、长文档等超长上下文,具备视觉 2D/3D 定位能力。
查看原文 →
Qwen3Guard 实时安全护栏模型(仍为博客最新一篇) 2025-09-23 安全
Qwen3Guard 是 Qwen 家族首款安全护栏模型,分 Qwen3Guard-Gen(生成式版,用于离线标注 / RL 奖励信号)与 Qwen3Guard-Stream(流式逐 token 检测)。提供 0.6B / 4B / 8B 三档参数,引入「争议性」第三档风险标签,支持 119 种语言,已上线 HuggingFace、ModelScope、阿里云 AI 安全护栏服务。
查看原文 →
数据源:https://qwen.ai/blog
Kimi / 月之暗面
中国 · 长上下文 + 代码 Agent
2 项更新
Kimi API 开放平台首页 banner 持续主推 K2.7 Code(当前最强 Coding 模型,高速版同步上线,限时促销中),并首次明示价格:缓存命中 ¥1.30 / 输入 ¥6.50 / 输出 ¥27.00 每百万 token。通用旗舰仍为 K2.6 多模态模型(256K 上下文),并保留 K2.5 视觉模型在售。
Kimi K2.7 Code 正式发布,公布定价 2026-Q2 新模型 / 价格
Kimi K2.7 Code 是月之暗面迄今最智能的 Coding 模型,高速版同步上线,主打长上下文中更可靠的指令遵循与更高的编程任务成功率;平台首页公示价格为缓存命中 ¥1.30 / MTok、输入 ¥6.50 / MTok、输出 ¥27.00 / MTok,与 K2.6 输入/输出同价、缓存命中略高,配套限时促销,完全兼容 OpenAI SDK。
查看原文 →
Kimi K2.6 多模态对话模型在售 2026-04-20 多模态
Kimi K2.6(kimi-k2.6)是 Kimi 最新最智能的通用模型,具备更强更稳的长程代码编写能力,显著增强 Agent 自主执行能力,支持文本、图片与视频输入,256K 上下文;定价缓存命中 ¥1.10 / 输入 ¥6.50 / 输出 ¥27.00 每百万 token。
查看原文 →
数据源:https://platform.moonshot.cn/
豆包 / 字节 Seed
中国 · 字节跳动 · 多模态 + 视频生成
3 项更新
字节 Seed 团队近 30 天 team.doubao.com 技术博客无新模型发布,最近一次为 2026-04-23 的 Seed3D 2.0;4 月还发布 Seed 全双工语音大模型,2 月连发 Seed2.0 通用大模型、Seedream 5.0 Lite 图像、Seedance 2.0 视频三件套。火山方舟(火山引擎)侧 Seedance 2.0 / Seedream 系列教程与 API 持续更新。
Seed3D 2.0 发布 2026-04-23 新模型 / 3D
字节 Seed 团队发布 Seed3D 2.0,相比 1.x 提供更高精度的 3D 生成能力与更强可用性,是 Seed 在 3D 内容生成方向的最新一代,也是博客近 30 天内最新一条模型发布。
查看原文 →
Seed 全双工语音大模型发布 2026-04-09 新模型 / 语音
Seed 全双工语音大模型(Seeduplex)发布,主打懂倾听、抗干扰,让语音交互在被打断与背景噪声场景下更自然、更接近真人对话节奏。
查看原文 →
Seed 2.0 通用大模型正式发布 2026-02-14 新模型
Seed2.0 是字节跳动 Seed 团队的新一代通用大模型,是后续 Seedream / Seedance / Seed3D 等多模态家族的基座;同周配套发布 Seedream 5.0 Lite(图像)与 Seedance 2.0(视频)。
查看原文 →
数据源:https://team.doubao.com/zh/blog
文心一言 / 百度
中国 · 百度 · ERNIE 系列 + 千帆
3 项更新
百度 ERNIE 博客近 30 天无新公告,最新仍为 ERNIE 5.1(2026-05-09 正式发布):以仅同等模型 6% 的预训练成本登顶多项榜单,LMArena Search Arena 中国第一。ERNIE-Image(8B DiT 文生图)与 2.4 万亿参数的 ERNIE 5.0 统一多模态基座共同构成其多模态家族。
ERNIE 5.1 正式发布,多榜单登顶 2026-05-09 新模型
ERNIE 5.1 正式发布,预训练成本仅为同等模型的 6%,在 LMArena Search Arena 上排名中国第一。底层采用 disaggregated fully-asynchronous reinforcement learning 与 scaled agentic post-training,在 Agent、推理、创意能力上全面升级;官方定位为更懂用户、写作更佳的下一代旗舰模型。这是 ERNIE 博客近 30 天内最新条目。
查看原文 →
ERNIE-5.1-Preview 在 LMArena 文本榜中国第一 2026-04-30 评测
LMArena 2026-04-30 发布最新排行榜,ERNIE-5.1-Preview 在 LMArena Text Arena 上中国第一、全球第 13 名,并在多个类别子榜单中进入全球 Top 10。
查看原文 →
ERNIE-Image 文生图模型发布 2026-04-15 图像生成
ERNIE-Image 是基于 single-stream Diffusion Transformer (DiT) 的文生图模型,DiT 参数 8B,是国内开源权重模型中处于领先水平的文生图模型,作为 ERNIE 多模态家族的图像分支补齐。
查看原文 →
数据源:https://yiyan.baidu.com/blog/
⚠️ 说明
本报告由 Baby Q 自动抓取整理,内容仅供参考。新模型/API/价格变更以厂商官方公告为准。报告每日 10:00(北京时间)自动更新。