跳到正文
热点事件持续更新

AWS介绍用SageMaker AI多轮强化学习微调搜索Agent方案

1 篇报道1 个报道来源22 小时前更新

先了解这件事

AI 综述

2026年10月2日,AWS Machine Learning Blog发文介绍了在Amazon SageMaker AI上使用多轮强化学习(MTRL)微调Qwen3.6-27B模型以构建企业搜索智能体的方法。该方案利用SageMaker AI MTRL支持的Serverless执行机制及内置的PPO、GRPO等算法,使模型在限定轮次内自主调用BM25与向量检索工具,直接优化跨多轮交互决策。根据报道中的条件说明,运行该实践需拥有访问美国西部(俄勒冈,us-west-2)区域Amazon SageMaker AI的AWS账户;所微调的Qwen3.6-27B模型在俄勒冈区域受支持;此外,MTRL服务默认设有24小时的时间限制,用户可通过CreateJob的JSON schema进行调整。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月2日
  1. AWS Machine Learning Blog
    在 Amazon SageMaker AI 上使用多轮强化学习微调搜索智能体

    AWS 展示了如何在 Amazon SageMaker AI 上使用多轮强化学习(MTRL)微调 Qwen3.6-27B 模型,以打造高效的企业搜索智能体。SageMaker AI MTRL 支持 Serverless 执行并内置 PPO、GRPO 等算法,使模型在受限轮次内自主调用 BM25 与向量检索工具,直接优化跨多轮交互决策。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。