🎯 竞品新能力周报
2026-07-22 · 8个平台更新
15
监控平台
8
本周更新
8
定制条目
国内平台
🌋
火山方舟
无更新
📄 https://www.volcengine.com/docs/82379/1159177 · 2026-07-22T02:05:00+08:00
更新
7月产品更新页面最新为202606(6月),7月无新产品功能更新
7月产品更新页面最新为202606(6月),7月无新产品功能更新
更新
模型发布公告202607(doubao-seed-evolving升级+GLM-5.2上线)和第九批模型下线通知已在上期7/15周报覆盖
模型发布公告202607(doubao-seed-evolving升级+GLM-5.2上线)和第九批模型下线通知已在上期7/15周报覆盖
⛰️
火山机器学习平台
无更新
📄 https://www.volcengine.com/docs/6459/1201678 · 2026-07-22T02:06:00+08:00
更新
最新Release Notes为2026.05(5月22日),7月无新更新
最新Release Notes为2026.05(5月22日),7月无新更新
🔍
百度千帆
无更新
📄 https://cloud.baidu.com/doc/qianfan/s/Mmh8l4qwj · 2026-07-22T02:08:00+08:00
更新
最新产品更新为2026年4月13日,最新模型退役记录为7月9日,7/15后无新更新
最新产品更新为2026年4月13日,最新模型退役记录为7月9日,7/15后无新更新
🌐
阿里百炼
有更新
📄 https://help.aliyun.com/zh/model-studio/model-release-notes · 2026-07-22T02:01:00+08:00
更新
7月16日:企业知识库旧版下线通知,建议迁移到新版知识库
7月16日:企业知识库旧版下线通知,建议迁移到新版知识库
更新
7月16日:Managed Agent正式商业化,从免费公测转为付费服务
7月16日:Managed Agent正式商业化,从免费公测转为付费服务
更新
7月14日:GLM-5.2 Fast mode降价,输入输出token价格下调
7月14日:GLM-5.2 Fast mode降价,输入输出token价格下调
海外平台
🎆
Fireworks
有更新
📄 https://docs.fireworks.ai/updates/changelog · 2026-07-22T02:04:00+08:00
🎯 模型定制能力
微调
SFT新增学习率调度器
Fireworks SFT微调功能新增学习率调度器(Learning Rate Scheduler),支持在SFT微调任务中配置学习率衰减策略(如cosine、linear等),帮助用户更精细地控制微调训练过程,提升模型收敛效果和最终质量
SFT
学习率调度器
微调优化
训练控制
https://docs.fireworks.ai/updates/changelog
📦
AWS Bedrock
有更新
📄 https://aws.amazon.com/about-aws/whats-new/recent/feed/ · 2026-07-22T02:07:00+08:00
更新
7月20日:AWS Data Exports新增Bedrock标准化产品元数据,FinOps团队可直接获取模型提供商、模型名称、推理类型、服务模式等结构化属性,无需自行解析CUR产品元数据
7月20日:AWS Data Exports新增Bedrock标准化产品元数据,FinOps团队可直接获取模型提供商、模型名称、推理类型、服务模式等结构化属性,无需自行解析CUR产品元数据
🧠
AWS SageMaker AI
有更新
📄 https://aws.amazon.com/about-aws/whats-new/recent/feed/ · 2026-07-22T02:07:00+08:00
🎯 模型定制能力
部署
HyperPod分区级网络拓扑支持
Amazon SageMaker HyperPod新增Slurm集群分区级网络拓扑配置,单个集群可在不同分区使用不同拓扑(UltraServer实例用block拓扑,层级互连实例用tree拓扑),自动匹配实例类型的互连特征,提升分布式训练中GPU间通信效率和NCCL集合操作吞吐量
HyperPod
网络拓扑
Slurm
分布式训练
NCCL
https://aws.amazon.com/about-aws/whats-new/2026/07/hyperpod-partition-topology-slurm/
☁️
Google Vertex AI
有更新
📄 https://docs.cloud.google.com/vertex-ai/docs/release-notes · 2026-07-22T02:09:00+08:00
更新
7月13日:Agent Platform Workbench实例新增Secure Boot兼容GPU支持,workbench-instances-2603镜像和workbench-container-2606自定义容器内置Secure Boot签名NVIDIA GPU驱动
7月13日:Agent Platform Workbench实例新增Secure Boot兼容GPU支持,workbench-instances-2603镜像和workbench-container-2606自定义容器内置Secure Boot签名NVIDIA GPU驱动
更新
7月6日:Agent Platform Workbench镜像更新,修复GPU实例JupyterLab不可达(HTTP 524)和长连接请求60秒被中断问题
7月6日:Agent Platform Workbench镜像更新,修复GPU实例JupyterLab不可达(HTTP 524)和长连接请求60秒被中断问题
🤝
Together AI
有更新
📄 https://docs.together.ai/docs/changelog · 2026-07-22T02:10:00+08:00
更新
7月17日:隐私和训练选择设置移至Organization Settings的Privacy页面,组织管理员统一管控API密钥的数据共享设置
7月17日:隐私和训练选择设置移至Organization Settings的Privacy页面,组织管理员统一管控API密钥的数据共享设置
更新
7月17日:Dedicated endpoint新增部署列表API,响应最多包含10个最新部署摘要
7月17日:Dedicated endpoint新增部署列表API,响应最多包含10个最新部署摘要
更新
7月16日:新Serverless模型上线thinkingmachines/Inkling(552.8B参数,524K上下文,NVFP4量化)
7月16日:新Serverless模型上线thinkingmachines/Inkling(552.8B参数,524K上下文,NVFP4量化)
更新
7月15日:TogetherLink发布,开源启动器连接Claude Code/Codex/ChatGPT Desktop等到Together AI模型
7月15日:TogetherLink发布,开源启动器连接Claude Code/Codex/ChatGPT Desktop等到Together AI模型
更新
7月15日:Slurm GPU集群OIDC SSH支持浏览器认证登录
7月15日:Slurm GPU集群OIDC SSH支持浏览器认证登录
更新
7月14日:新Serverless模型google/gemma-4-12B-it(262K上下文)
7月14日:新Serverless模型google/gemma-4-12B-it(262K上下文)
更新
7月14日:GPU集群被动健康检查文档更新,新增监控信号和修复建议
7月14日:GPU集群被动健康检查文档更新,新增监控信号和修复建议
🎯 模型定制能力
微调
微调训练指标仪表盘
Together AI新增微调任务Metrics仪表盘,实时展示训练loss、学习率、梯度范数等指标曲线,支持DPO偏好训练的reward accuracy/margin/KL等指标,可多任务对比、缩放平移、切换步数/时间轴、线形/对数刻度
微调指标
训练曲线
DPO
实时监控
多任务对比
https://docs.together.ai/docs/changelog
微调
微调前置检查API
Together AI微调模型limits端点新增supports_full_training字段,用户可在提交微调任务前检查模型是否支持全量微调(full fine-tuning),当字段为false时模型仅支持LoRA微调,避免提交不支持的任务类型
微调前置检查
full training
LoRA
limits API
https://docs.together.ai/docs/changelog
评测
图像输入支持模型评测
Together AI评测功能新增图像数据集支持,可在评测数据集中添加image_data_urls列(base64图片数据URL或列表),自动将图片附加到模型和judge请求中,支持对视觉模型的图像理解能力进行量化评测
图像评测
视觉模型
image_data_urls
多模态评测
https://docs.together.ai/docs/changelog
部署
Dedicated Model Inference(专用模型推理)
Together AI推出Dedicated Model Inference(DMI),在预留GPU上提供模型推理服务,更高吞吐量、更低延迟、无硬限流,与Serverless共享同一推理API。支持一键部署、A/B测试/影子实验、自动扩缩容和scale-to-zero
DMI
专用推理
预留GPU
A/B测试
自动扩缩容
影子实验
https://docs.together.ai/docs/changelog
🏃
RunPod
有更新
📄 https://docs.runpod.io/release-notes · 2026-07-22T02:11:00+08:00
🎯 模型定制能力
部署
Instant Clusters弹性扩容(Beta)
RunPod Instant Clusters新增弹性扩容功能(Beta),用户可向运行中的集群添加Pod增加GPU算力而无需重建集群,新Pod自动加入集群私有网络并匹配GPU类型、模板和网络存储
Instant Clusters
弹性扩容
GPU扩容
Beta
https://docs.runpod.io/release-notes
部署
Serverless Worker亲和性路由
RunPod Serverless负载均衡端点新增Worker亲和性功能,用户可通过X-Runpod-Worker-Id响应头将后续请求固定到同一Worker,支持soft/strict/strict-resume三种模式,适用于有状态工作负载避免会话状态重载
Worker亲和性
负载均衡
有状态工作负载
会话保持
https://docs.runpod.io/release-notes
🎨
Novita AI
有更新
📄 https://novita.ai/docs/changelog/ · 2026-07-22T02:12:00+08:00
更新
7月7日发布模型退役通知:7月22日将退役16款图像和视频模型,包括Upscale/Remove Background/Replace Background/Inpainting/Remove Text/Cleanup/Image-to-Prompt等7款图像编辑工具,以及Kling V2.5 Turbo/Kling-o1/Kling V2.6 Pro/PixVerse V4.5/VIDU Q2系列/Vidu Q3系列等9款视频模型,建议迁移到Kling v3.0
7月7日发布模型退役通知:7月22日将退役16款图像和视频模型,包括Upscale/Remove Background/Replace Background/Inpainting/Remove Text/Cleanup/Image-to-Prompt等7款图像编辑工具,以及Kling V2.5 Turbo/Kling-o1/Kling V2.6 Pro/PixVerse V4.5/VIDU Q2系列/Vidu Q3系列等9款视频模型,建议迁移到Kling v3.0