LLM-Agent-Benchmark-List
开源
一站式查找 LLM 智能体评估基准,省去全网搜索时间
LLM-Agent-Benchmark-List 是一个专门收集和整理大语言模型(LLM)智能体(Agent)评估基准(Bench···
LLM-Agent-Benchmark-List
开源
一站式查找 LLM 智能体评估基准,省去全网搜索时间
LLM-Agent-Benchmark-List 是一个专门收集和整理大语言模型(LLM)智能体(Agent)评估基准(Bench···
LLM_MultiAgents_Survey_Papers
开源
一篇论文看懂LLM多智能体领域全貌
这是一份关于基于大语言模型的多智能体系统的综述论文,发表于IJCAI 2024。论文系统梳理了LLM多智能···
ScienceAgentBench
开源
用102个真实科研任务,严格检验AI科学智能体成色
ScienceAgentBench 是一个面向数据驱动科学发现的语言智能体评估基准,由加州大学等机构在 ICLR 20···
Awesome-Human-Agent-Collaboration-In···
开源
一网打尽LLM人机协作前沿资源,快速入门研究
这是一个围绕“大语言模型驱动的人机协作与交互系统”的精选资源清单,源自ACL 2026的综述论文。项···
Awesome-Graphs-Meet-Agents
开源
一张地图看懂图与智能体如何互相成就
这是一个持续更新的资源清单,聚焦图与智能体(Agents)的交叉领域。它系统整理了图增强智能体(即···
Awesome-Remote-Sensing-Agents
开源
一页看懂遥感智能体研究全景,快速上手前沿方向
这是一个遥感智能体领域的综述性开源项目,汇集了遥感智能体(Remote Sensing Agents)相关的论文、···
burp-ai-agent
开源
在 Burp Suite 里直接调用 AI,自动分析流量、发现漏洞,省时省力。
burp-ai-agent 是一个 Burp Suite 扩展,为安全测试人员提供内置的 MCP(模型上下文协议)工具集成···
agent-flow
开源
实时可视化 Claude Code 代理思考与协作,调试更直观。
agent-flow 是一个用于实时可视化 Claude Code 代理编排的开源工具。它解决了开发者在运行 Claude ···
HyperAgent
开源
说句话就能让浏览器自己干活,省去写脚本的麻烦
HyperAgent 是一个基于 TypeScript 构建的开源 AI 浏览器自动化框架,旨在通过自然语言指令驱动浏览···
AgentEvolver
开源
让AI智能体自己进化,越用越聪明,少调参
AgentEvolver 是一个面向智能体系统的高效自进化框架,旨在解决大语言模型驱动的智能体在复杂任务中···
awesome-llm-agents
开源
一站式找到最火的LLM智能体框架,告别选择困难
这是一个精选的LLM智能体框架与资源清单,汇集了当前最优秀的开源智能体项目、工具和论文。它解决了···
MLE-agent
开源
读论文、写代码、做研究,一个助手全搞定
MLE-agent 是一个面向 AI 工程与研究的智能助手,旨在将大模型与科研工作流深度结合。它解决了研究···