跳到正文

技术方向

Agent 智能体 最新动态

让模型自主规划、调用工具、完成多步任务的技术方向——从 Claude Code、Manus 到各家 Agent 框架与评测基准的全部动态。

127 条精选近 30 天 19 条共收录 275 条

更新

精选归档 · 第 7 页

1月23日周四第 121–127 条
  1. OpenAI News63

    OpenAI 发布 Operator 系统卡片

    OpenAI 发布 Operator 系统卡片,详细介绍了保障该系统安全运行的多层防护机制。文档重点涵盖了防范提示词工程与越狱攻击的模型及产品级缓解措施,并披露了隐私安全保护、外部红队测试与安全评估的实施情况。

    推荐理由:文档披露了针对智能体提示词越狱的多层防护方案与红队评估细节,为相关产品的安全设计提供了参考。

12月31日周二
  1. Hugging Face Blog82

    Hugging Face 发布轻量级智能体库 smolagents

    Hugging Face 正式推出轻量级开源智能体库 smolagents,主打让大语言模型直接通过可执行 Python 代码来表达与调用工具动作。该库核心代码仅约千行并支持 E2B 沙盒执行环境,未来将取代旧版 transformers.agents。它深度集成了 Hugging Face Hub 工具生态,并可通过 LiteLLM 接入开源模型及主流商业模型。

    推荐理由:原文展示了用可执行代码替代传统 JSON 工具调用的智能体设计,为需要高灵活性与轻量化架构的开发者提供了参考。

1月10日周三
11月6日周一
7月24日周一
9月17日周二
  1. OpenAI News74

    OpenAI 研究发现多智能体交互中涌现出复杂工具使用能力

    OpenAI 观察到多智能体在模拟捉迷藏游戏中能自发发现并使用越来越复杂的工具。智能体通过自监督训练构建了 6 种截然不同的策略与反制策略,其中部分策略甚至超出了研究团队对环境支持能力的既有认知。研究表明,简单环境下的多智能体协同适应未来可能演化出极度复杂的智能行为。

    推荐理由:多智能体在简单博弈环境中自发演化出多阶段攻防策略,为利用多智能体协同适应探索复杂智能行为提供了实验参考。

6月25日周一