🎯 竞品新能力周报
2026-07-15 · 8个平台更新
15
监控平台
8
本周更新
22
定制条目
国内平台
🌋
火山方舟
有更新
📄 https://www.volcengine.com/docs/82379/1159177 · 2026-07-15T02:05:00+08:00
更新
7月:doubao-seed-evolving版本更新,支持1M超长上下文,长程任务稳定性增强,tokens消耗更少,工具调用更简洁
7月:doubao-seed-evolving版本更新,支持1M超长上下文,长程任务稳定性增强,tokens消耗更少,工具调用更简洁
更新
7月:新发布GLM-5.2(glm-5-2-260617),面向长程自主编码场景的旗舰开源模型,1M上下文,开源SOTA
7月:新发布GLM-5.2(glm-5-2-260617),面向长程自主编码场景的旗舰开源模型,1M上下文,开源SOTA
更新
7月3日:第九批模型下线启动通知,15款模型将分阶段下线,7/10停止新购,9/21正式下线
7月3日:第九批模型下线启动通知,15款模型将分阶段下线,7/10停止新购,9/21正式下线
更新
下线模型包括:kimi-k2-5-260127、glm-4-7-251222、deepseek-v3-2-251201(7/30提前下线)、doubao-seed-code-preview、doubao-seed-1.5/1.6系列等
下线模型包括:kimi-k2-5-260127、glm-4-7-251222、deepseek-v3-2-251201(7/30提前下线)、doubao-seed-code-preview、doubao-seed-1.5/1.6系列等
🎯 模型定制能力
模型
doubao-seed-evolving升级:支持1M超长上下文
doubao-seed-evolving版本更新,支持1M超长上下文,长程任务稳定性增强,tokens消耗更少,工具调用更简洁。版本升级自动生效,通过统一Model ID doubao-seed-evolving调用即可获取最新版本
doubao-seed-evolving
1M上下文
版本升级
工具调用优化
https://www.volcengine.com/docs/82379/1159177
模型
新发布GLM-5.2
新发布GLM-5.2(glm-5-2-260617),面向长程自主编码场景的旗舰开源模型。全面强化大型代码库工程、长程任务规划与工具协同能力,多个榜单开源第一,支持真正可用的1M上下文,一次任务贯通需求到多端可部署产物的完整开发链路
GLM-5.2
开源SOTA
1M上下文
编码
智能体
https://www.volcengine.com/docs/82379/1159177
模型
第九批15款模型下线
第九批模型下线通知:7/3启动配额下调,7/10停止新购,9/21正式下线。下线模型:kimi-k2-5-260127→doubao-seed-evolving、glm-4-7-251222→glm-5-2-260617、deepseek-v3-2-251201(7/30下线)→deepseek-v4-flash、doubao-seed-code-preview→doubao-seed-evolving、doubao-seed-1.5/1.6系列→doubao-seed-2.0系列
模型下线
Kimi-K2.5
GLM-4.7
DeepSeek-V3.2
迁移指引
https://www.volcengine.com/docs/82379/1159177
⛰️
火山机器学习平台
无更新
📄 https://www.volcengine.com/docs/6459/2206987 · 2026-07-15T02:06:00+08:00
更新
最新Release Notes为2026.05(5月),7月无新更新
最新Release Notes为2026.05(5月),7月无新更新
🔍
百度千帆
无更新
📄 https://cloud.baidu.com/doc/qianfan/s/Mmh8l4qwj · 2026-07-15T02:08:00+08:00
更新
最新更新为2026年4月13日(上线GLM-5.1),7月无新更新
最新更新为2026年4月13日(上线GLM-5.1),7月无新更新
🌐
阿里百炼
有更新
📄 https://help.aliyun.com/zh/model-studio/model-release-notes · 2026-07-15T02:01:00+08:00
更新
7月13日:网关变更通告,部分模型API网关升级调整
7月13日:网关变更通告,部分模型API网关升级调整
更新
7月10日:部分老旧模型下线通知
7月10日:部分老旧模型下线通知
更新
7月9日:析言GBI产品退市 + 部分长尾模型下线通知
7月9日:析言GBI产品退市 + 部分长尾模型下线通知
更新
7月6日:部分老旧模型延期下线通知(上期已覆盖)
7月6日:部分老旧模型延期下线通知(上期已覆盖)
🎯 模型定制能力
部署
网关变更通告
7月13日发布网关变更通告,部分模型API网关将进行升级调整,可能影响调用路径或请求方式,建议关注官方公告了解具体影响范围和迁移方案
网关变更
API升级
迁移
https://help.aliyun.com/zh/model-studio/model-release-notes
模型
部分老旧模型下线通知
7月10日发布老旧模型下线通知,部分长期未使用的模型将逐步下线,建议用户尽快迁移到替代模型
模型下线
老旧模型
迁移
https://help.aliyun.com/zh/model-studio/model-release-notes
模型
析言GBI产品退市
7月9日宣布析言GBI产品退市,该产品将不再提供服务。同时发布部分长尾模型下线通知
产品退市
析言GBI
模型下线
https://help.aliyun.com/zh/model-studio/model-release-notes
海外平台
🎆
Fireworks
有更新
📄 https://docs.fireworks.ai/updates/changelog · 2026-07-15T02:04:00+08:00
更新
音频推理和图像生成功能弃用(新增变更,上期未覆盖)
音频推理和图像生成功能弃用(新增变更,上期未覆盖)
更新
Serverless弃用:Kimi K2.5和Qwen 3.6 Plus→迁移到K2.6和3.7 Plus(上期已覆盖)
Serverless弃用:Kimi K2.5和Qwen 3.6 Plus→迁移到K2.6和3.7 Plus(上期已覆盖)
更新
Serverless弃用:MiniMax M2.5→迁移到M2.7(上期已覆盖)
Serverless弃用:MiniMax M2.5→迁移到M2.7(上期已覆盖)
更新
新模型上线:GLM 5.2、Kimi K2.7 Code、MiniMax M3、Qwen 3.7 Plus(上期已覆盖)
新模型上线:GLM 5.2、Kimi K2.7 Code、MiniMax M3、Qwen 3.7 Plus(上期已覆盖)
🎯 模型定制能力
部署
音频推理和图像生成功能弃用
Fireworks宣布弃用音频推理和图像生成功能,相关API将逐步停止服务,建议用户迁移到其他替代方案
功能弃用
音频推理
图像生成
迁移
https://docs.fireworks.ai/updates/changelog
📦
AWS Bedrock
有更新
📄 https://aws.amazon.com/about-aws/whats-new/recent/feed/ · 2026-07-15T02:07:00+08:00
更新
7月13日:OpenAI GPT-5.6 Sol、GPT-5.6 Terra、GPT-5.6 Luna 现已GA on Amazon Bedrock
7月13日:OpenAI GPT-5.6 Sol、GPT-5.6 Terra、GPT-5.6 Luna 现已GA on Amazon Bedrock
更新
7月9日:Amazon Bedrock支持OAuth for MCP Server
7月9日:Amazon Bedrock支持OAuth for MCP Server
🎯 模型定制能力
部署
Bedrock支持OAuth for MCP Server
Amazon Bedrock新增OAuth for MCP Server支持,客户可使用OAuth认证协议安全连接MCP Server,增强Agent工具调用的安全性和互操作性
MCP
OAuth
安全
Agent工具
https://aws.amazon.com/about-aws/whats-new/recent/feed/
模型
GPT-5.6 Sol/Terra/Luna GA on Bedrock
OpenAI最新GPT-5.6系列三款模型(Sol、Terra、Luna)现已在Amazon Bedrock正式GA。客户可通过Bedrock API直接调用,无需自建基础设施
GPT-5.6
Sol
Terra
Luna
Bedrock
GA
https://aws.amazon.com/about-aws/whats-new/2026/07/openai-gpt-5-6-sol-terra-luna-ga-amazon-bedrock/
🧠
AWS SageMaker AI
有更新
📄 https://aws.amazon.com/about-aws/whats-new/recent/feed/ · 2026-07-15T02:07:00+08:00
更新
7月13日:Gemma-4-E2B-it上线SageMaker JumpStart
7月13日:Gemma-4-E2B-it上线SageMaker JumpStart
更新
7月13日:OpenAI privacy-filter上线SageMaker JumpStart(PII检测)
7月13日:OpenAI privacy-filter上线SageMaker JumpStart(PII检测)
更新
7月13日:Qwen3 embedding和reranking模型上线SageMaker JumpStart
7月13日:Qwen3 embedding和reranking模型上线SageMaker JumpStart
更新
7月13日:Voxtral-Mini-4B-Realtime上线SageMaker JumpStart
7月13日:Voxtral-Mini-4B-Realtime上线SageMaker JumpStart
更新
7月13日:SageMaker HyperPod支持custom AMI for Slurm clusters
7月13日:SageMaker HyperPod支持custom AMI for Slurm clusters
更新
7月10日:SageMaker HyperPod AMI-based continuous provisioning
7月10日:SageMaker HyperPod AMI-based continuous provisioning
🎯 模型定制能力
部署
HyperPod支持custom AMI for Slurm
SageMaker HyperPod新增custom AMI支持,用户可在Slurm集群中使用自定义AMI,灵活配置集群运行环境
HyperPod
custom AMI
Slurm
集群配置
https://aws.amazon.com/about-aws/whats-new/recent/feed/
部署
HyperPod AMI-based continuous provisioning
SageMaker HyperPod新增基于AMI的持续配置能力,支持AMI方式的集群持续供给和自动更新
HyperPod
AMI
持续配置
自动更新
https://aws.amazon.com/about-aws/whats-new/recent/feed/
模型
Gemma-4-E2B-it上线JumpStart
Google DeepMind开源模型Gemma-4-E2B-it现已在SageMaker JumpStart可用,支持文本和图像输入、文本输出,2B参数高效推理
Gemma-4-E2B-it
JumpStart
开源模型
https://aws.amazon.com/about-aws/whats-new/recent/feed/
微调
OpenAI privacy-filter上线JumpStart
OpenAI隐私过滤器(privacy-filter)现已在SageMaker JumpStart可用,用于PII检测和数据脱敏,帮助企业在模型训练和推理中保护敏感信息
privacy-filter
PII检测
数据脱敏
JumpStart
https://aws.amazon.com/about-aws/whats-new/recent/feed/
模型
Qwen3 embedding/reranker上线JumpStart
通义千问Qwen3系列embedding和reranking模型现已在SageMaker JumpStart可用,支持文本嵌入和检索重排序,提升RAG应用检索精度
Qwen3
embedding
reranker
RAG
JumpStart
https://aws.amazon.com/about-aws/whats-new/recent/feed/
模型
Voxtral-Mini-4B-Realtime上线JumpStart
Mistral音频模型Voxtral-Mini-4B-Realtime现已在SageMaker JumpStart可用,支持实时语音识别和转录
Voxtral
语音识别
实时转录
JumpStart
https://aws.amazon.com/about-aws/whats-new/recent/feed/
☁️
Google Vertex AI
有更新
📄 https://cloud.google.com/vertex-ai/docs/release-notes · 2026-07-15T02:09:00+08:00
更新
7月13日:Colab Enterprise安全公告GCP-2026-047(BigQuery/Dataform/Colab Enterprise跨租户仓库接管漏洞)
7月13日:Colab Enterprise安全公告GCP-2026-047(BigQuery/Dataform/Colab Enterprise跨租户仓库接管漏洞)
更新
5月26日:Vertex AI Extensions下线通告(11月26日后关闭,建议迁移到Agent Platform)
5月26日:Vertex AI Extensions下线通告(11月26日后关闭,建议迁移到Agent Platform)
🎯 模型定制能力
部署
Vertex AI Extensions下线通告
Vertex AI Extensions已宣布弃用,将在2026年11月26日后关闭服务。建议用户迁移到Agent Platform以避免服务中断
Extensions下线
Agent Platform迁移
弃用
https://cloud.google.com/vertex-ai/docs/release-notes
🤝
Together AI
有更新
📄 https://docs.together.ai/docs/changelog · 2026-07-15T02:10:00+08:00
更新
7月10日:Provisioned Throughput正式上线,支持MiniMax-M3和GLM-5.2的预留吞吐量
7月10日:Provisioned Throughput正式上线,支持MiniMax-M3和GLM-5.2的预留吞吐量
更新
7月10日:新Serverless模型上线:flash-image-3.1-lite、Qwen3.6-35B-A3B-Lora、happyhorse-1.1系列(i2v/r2v/t2v)
7月10日:新Serverless模型上线:flash-image-3.1-lite、Qwen3.6-35B-A3B-Lora、happyhorse-1.1系列(i2v/r2v/t2v)
更新
7月10日:新微调模型:gemma-4-31B-it-VLM
7月10日:新微调模型:gemma-4-31B-it-VLM
更新
7月10日:3款模型弃用:Qwen3-235B-A22B-Instruct-2507-tput、Meta-Llama-3-8B-Instruct-Lite、GLM-5.1
7月10日:3款模型弃用:Qwen3-235B-A22B-Instruct-2507-tput、Meta-Llama-3-8B-Instruct-Lite、GLM-5.1
更新
7月10日:BYOM支持Transformers v5、GPU集群区域选择优化、GPU集群存储性能健康检查
7月10日:BYOM支持Transformers v5、GPU集群区域选择优化、GPU集群存储性能健康检查
🎯 模型定制能力
部署
Provisioned Throughput正式上线
Together AI正式推出Provisioned Throughput功能,支持MiniMax-M3和GLM-5.2的预留吞吐量购买,用户可按需预留GPU推理算力,保障高吞吐场景的服务稳定性
Provisioned Throughput
预留吞吐量
MiniMax-M3
GLM-5.2
https://docs.together.ai/docs/changelog
部署
BYOM支持Transformers v5 + GPU集群优化
Together AI BYOM(Bring Your Own Model)新增Transformers v5支持,用户可部署基于最新Transformers库的模型。GPU集群新增区域选择和存储性能健康检查功能
BYOM
Transformers v5
GPU集群
区域选择
https://docs.together.ai/docs/changelog
模型
新Serverless模型上线:flash-image-3.1-lite等
Together AI新增3组Serverless模型:flash-image-3.1-lite(轻量图像模型)、Qwen3.6-35B-A3B-Lora(支持LoRA的MoE模型)、happyhorse-1.1系列(i2v/r2v/t2v三种视频生成模型)
flash-image-3.1-lite
Qwen3.6-35B-Lora
happyhorse-1.1
新模型
https://docs.together.ai/docs/changelog
微调
新增gemma-4-31B-it-VLM微调模型
Together AI新增gemma-4-31B-it-VLM微调模型,支持视觉语言模型(VLM)的定制化微调,可针对特定领域优化多模态理解能力
gemma-4-31B
VLM微调
多模态
定制化
https://docs.together.ai/docs/changelog
模型
3款模型弃用下线
Together AI弃用3款模型:Qwen3-235B-A22B-Instruct-2507-tput(已有tput版本替代)、Meta-Llama-3-8B-Instruct-Lite(旧版Llama3)、GLM-5.1(建议迁移到GLM-5.2)
模型下线
Qwen3-235B
Llama-3-8B
GLM-5.1
https://docs.together.ai/docs/changelog
🏃
RunPod
有更新
📄 https://docs.runpod.io/release-notes · 2026-07-15T02:11:00+08:00
更新
7月1日:Serverless endpoint创建流程升级(6种部署路径,上期已覆盖)
7月1日:Serverless endpoint创建流程升级(6种部署路径,上期已覆盖)
更新
7月1日:支持Deploy Pods with private AWS ECR images(Beta)
7月1日:支持Deploy Pods with private AWS ECR images(Beta)
🎯 模型定制能力
部署
支持AWS ECR私有镜像部署Pods
RunPod新增Beta功能:支持使用私有AWS ECR(Elastic Container Registry)镜像部署Pods,用户无需将镜像推送到公共仓库,直接从AWS ECR拉取私有镜像运行
AWS ECR
私有镜像
Pods部署
Beta
https://docs.runpod.io/release-notes