利用 AI 解放双手:把“贾维斯”带进现实 | 开源专题 No.64

Significant-Gravitas/AutoGPT

Stars: 160k License: MIT

AutoGPT 是开源 AI 代理生态系统的核心工具包。

  • 提供构建、测试和委托 AI 代理的工具。
  • AutoGPT 处于 AI 创新前沿,提供文档、贡献指南以及快速开始创建自己的代理。
  • 包含强大的组件如 Forge 和 Benchmark,帮助用户快速开发并衡量代理性能。
  • 通过 Leaderboard 可以提交基准运行结果,并与其他代理竞争。CLI 和 UI 界面使得操作更加简单易用。

reworkd/AgentGPT

Stars: 29.2k License: GPL-3.0

AgentGPT 是一个在浏览器中组装、配置和部署自主 AI 代理的项目。

  • 可以配置和部署自主 AI 代理。
  • 自定义 AI 名称,并让其实现任何想象得到的目标。
  • 通过思考任务、执行任务并从结果中学习,尝试达成目标。
  • 提供了快速开始指南,包括 CLI 设置环境变量、数据库、后端和前端等内容。
  • 技术栈包括 Nextjs, Typescript, FastAPI 等。

OpenInterpreter/open-interpreter

Stars: 42.8k License: AGPL-3.0

open-interpreter 是一个为计算机提供自然语言接口的项目。

  • 提供本地运行代码(Python、Javascript、Shell 等)的能力
  • 通过类似 ChatGPT 的界面在终端中与 Open Interpreter 进行交互
  • 提供自然语言接口来控制计算机通用功能,如创建和编辑照片、视频、PDF 等,控制 Chrome 浏览器进行研究,绘图分析大型数据集等
  • 可以克服其他服务限制,在本地环境中运行,并具有完全访问互联网和任何包或库的能力。

microsoft/JARVIS

Stars: 22.8k License: MIT

JARVIS 是一个连接 LLMs 与 ML 社区的系统。

  • 探索人工通用智能(AGI)并将尖端研究传递给整个社区
  • 提供 Easytool 以实现更简单的工具使用
  • 发布 TaskBench 用于评估 LLMs 的任务自动化能力
  • 支持 OpenAI 服务和 GPT-4 模型
  • 添加了 Gradio 演示和构建了 Web API,支持 CLI 模式,并提供配置参数来调整本地端点规模

lavague-ai/LaVague

Stars: 3.0k License: Apache-2.0

LaVague 是一个使用大型动作模型框架自动生成自动化工作流的项目。

  • 自然语言处理:理解自然语言指令以执行浏览器交互。
  • Selenium 集成:与 Selenium 无缝集成,用于自动化 Web 浏览器。
  • 开源项目:基于开源项目构建,如 transformers 和 llama-index,并利用本地或远程的开源模型,确保代理透明度并与用户利益一致。
  • 本地模型实现隐私和控制:支持像 Gemma-7b 这样的本地模型,使用户可以完全控制他们的 AI 助手并获得隐私保证。
  • 高级 AI 技术:首先使用本地嵌入(bge-small-en-v1.5)执行 RAG 以提取最相关 HTML 片段来满足 LLM 回答查询所需。然后利用 Few-shot 学习和 Chain of Thought 来引出最相关 Selenium 代码进行操作而无需对 LLM 进行微调(Nous-Hermes-2-Mixtral -8x7B-DPO)以生成代码。
相关推荐
笔触狂放3 分钟前
【机器学习】第八章 模型评估及改进
人工智能·深度学习·机器学习
AI训练师3 分钟前
基于深度学习的YOLO框架的7种交通场景识别项目系统【附完整源码+数据集】
人工智能
柠檬味拥抱5 分钟前
基于YOLOv8的狗狗品种(多达60种常见犬类)品种鉴别识别项目|完整源码数据集+PyQt5界面+完整训练流程+开箱即用!
人工智能
HelloGitHub17 分钟前
开源新旗舰 GLM-4.5:不想刷榜,只想干活儿
人工智能·开源·github
虹科数字化与AR21 分钟前
安宝特案例丨AR+AI赋能轨道交通制造:破解人工装配难题的创新实践
人工智能·ar·制造·轨道交通·工业ar·ai辅助·ar工业
陈敬雷-充电了么-CEO兼CTO21 分钟前
字节跳动开源Coze,开启AI Agent开发新时代?
人工智能·gpt·chatgpt·开源·大模型·agi·coze
说私域25 分钟前
基于开源AI智能名片链动2+1模式与S2B2C商城小程序的微商品牌规范化运营研究
人工智能·小程序·开源
程思扬25 分钟前
无界设计新生态:Penpot开源平台与cpolar的云端协同创新实践
大数据·linux·服务器·前端·经验分享·ubuntu·开源
强德亨上校28 分钟前
2025年7月21–28日AI开发周报:新模型、新战略与开源亮点
人工智能·科技·gpt·chatgpt·开源·aigc
亚马逊云开发者29 分钟前
Amazon Bedrock Runtime API集成指南——从Invoke Model API迁移到Converse API,简化生成式AI应用开发
人工智能·api