阿里巴巴开源自主搜索 AI 智能体 WebAgent
创始人
2025-05-30 07:12:41
0

IT之家 5 月 30 日消息,阿里巴巴昨日在 Github 上开源了其创新的自主搜索 AI Agent——WebAgent,具备端到端的自主信息检索与多步推理能力,能够像人类一样在网络环境中主动感知、决策和行动。

例如,当用户想了解某个特定领域的最新研究成果时,WebAgent 能够主动搜索多个学术数据库,筛选出最相关的文献,并根据用户的需求进行深入分析和总结。

据介绍,WebAgent 不仅能识别文献中的关键信息,还能通过多步推理将不同文献中的观点进行整合,最终为用户提供一份全面且精准的研究报告。

阿里巴巴 WebAgent 分为 WebDancer 和 WebWalker,前者是一种端到端智能体训练框架,旨在增强基于网络的 AI 智能体的多步骤信息搜索能力;后者则属于“Web 遍历中的 LLM 基准测试”。

Web Agents 上的性能:

WebDancer 的框架一共由 4 大块组成,从数据构建到训练优化,逐步打造出能够自主完成复杂信息检索任务的智能体。

浏览数据构建是整个框架的起点。在现实世界中,高质量的训练数据是智能体能够有效学习和泛化的关键。WebDancer 通过两种创新的数据合成方法来解决传统数据集的局限性。

为了确保生成的轨迹既有效又连贯,WebDancer 采用了短推理和长推理两种方法。短推理利用大模型直接生成简洁的推理路径,而长推理则通过推理模型逐步构建复杂的推理过程。

在数据准备完成后,WebDancer 进入监督微调(SFT)阶段。这一阶段的目标是通过高质量的轨迹数据对智能体进行初始化训练,使其能够适应信息检索任务的格式和环境要求。

在 SFT 过程中,WebDancer 将轨迹中的思考、行动和观察内容分别标记,并计算损失函数,以优化模型的参数。为了提高模型的鲁棒性,WebDancer 在计算损失时排除了外部反馈的影响,确保模型能够专注于自主决策过程。这一阶段的训练为智能体提供了强大的初始能力,使其能够在后续的强化学习阶段更好地适应复杂的任务环境。

强化学习(RL)阶段是 WebDancer 框架的关键环节。在这一阶段,智能体通过与环境的交互,学习如何在复杂的任务中做出最优决策。WebDancer 采用了 DAPO 算法,这是一种专门针对智能体训练设计的强化学习算法。

DAPO 算法通过动态采样机制,有效利用未充分利用的 QA 对,提高数据效率和策略的鲁棒性。在 RL 过程中,智能体通过多次尝试和反馈,逐步优化其决策策略,最终实现高效的多步推理和信息检索能力。

IT之家附 WebAgent 官方地址:

  • Github:https://github.com/Alibaba-NLP/WebAgent
  • WebDancer 论文:https://arxiv.org/pdf/2505.22648
  • WebWalker 论文:https://arxiv.org/pdf/2501.07572

相关内容

原创 ...
面向大学生的就业与创业,我们的高等教育到底能做些什么? 近日,新东...
2026-05-12 00:37:58
喜报 | 软通动力成功中标...
软通动力成功中标中国国新资产管理有限公司(简称 “国新资产”)AI...
2026-05-12 00:36:54
AI会取代哪些职业?多个A...
新华社北京5月11日电 当前,人们日益担忧人工智能(AI)将影响就...
2026-05-12 00:35:27
双方联手!讯方技术×网联华...
近日,深圳市讯方技术股份有限公司与成都网联华方科技有限公司在成都正...
2026-05-11 22:26:18
刚刚,重磅发布!AI,大利...
AI迎来重磅利好政策。 5月11日,据广州市人民政府网站,广州市人...
2026-05-11 22:26:07
新华三正重新定义AI基础设...
通信世界网消息(CWW)AI产业正在进入一个微妙阶段。 一边,是全...
2026-05-11 22:18:21

热门资讯

2024云栖大会|阿里云升级无... 北京商报讯(记者魏蔚)9月20日,阿里云无影AI云电脑在2024云栖大会上展出,该版本基于最新的终端...
MWC2025荣耀多款AI技术... 人民财讯3月6日电,2025世界移动通信大会(MWC 2025)上,荣耀MagicBook Pro ...
原创 2... #春日生活好物种草季#近年来,笔记本电脑市场迎来技术爆发期,尤其在手机厂商跨界入局后,轻薄本在性能、...
AMD锐龙AI 9 HX 37... 2024年6月3日,AMD正式发布全新的锐龙AI 300系列处理器。该系列处理器一经发布就引发大家的...
5个AI模特生成软件推荐 当前AI模特生成软件市场提供了多样化的解决方案,以下是几款备受推崇的工具: 触站AI:强烈推荐!...
骁龙本这么猛?联想YOGA A... 在人人都是自媒体的时代,一部手机可以解决出镜拍摄问题,而商务出差、大量码字、图像处理等需求用笔记本则...
摩尔线程发布AI算力笔记本MT... 钛媒体App 12月20日消息,摩尔线程创始人、董事长兼CEO张建中在摩尔线程首届MUSA开发者大会...
2023年CentOS与Ubu... CentOS与Ubuntu的市场格局与技术特性探讨 在服务器操作系统领域,CentOS与Ubuntu...
苹果macOS 15.1:允许... 苹果公司在其最新的macOS 15.1版本中,推出了一项引人注目的新功能——允许用户将Mac App...
原创 华... 在2024年这个被誉为"AI元年"的关键时刻,随着生成式AI的流行,各家手机厂商都在积极备战AI手机...