利用 AI 解放双手：把“贾维斯”带进现实 | 开源专题 No.64

开源服务指南2024-06-02 8:07

Significant-Gravitas/AutoGPT

Stars: 160k License: MIT

AutoGPT 是开源 AI 代理生态系统的核心工具包。

提供构建、测试和委托 AI 代理的工具。
AutoGPT 处于 AI 创新前沿，提供文档、贡献指南以及快速开始创建自己的代理。
包含强大的组件如 Forge 和 Benchmark，帮助用户快速开发并衡量代理性能。
通过 Leaderboard 可以提交基准运行结果，并与其他代理竞争。CLI 和 UI 界面使得操作更加简单易用。

reworkd/AgentGPT

Stars: 29.2k License: GPL-3.0

AgentGPT 是一个在浏览器中组装、配置和部署自主 AI 代理的项目。

可以配置和部署自主 AI 代理。
自定义 AI 名称，并让其实现任何想象得到的目标。
通过思考任务、执行任务并从结果中学习，尝试达成目标。
提供了快速开始指南，包括 CLI 设置环境变量、数据库、后端和前端等内容。
技术栈包括 Nextjs, Typescript, FastAPI 等。

OpenInterpreter/open-interpreter

Stars: 42.8k License: AGPL-3.0

open-interpreter 是一个为计算机提供自然语言接口的项目。

提供本地运行代码（Python、Javascript、Shell 等）的能力
通过类似 ChatGPT 的界面在终端中与 Open Interpreter 进行交互
提供自然语言接口来控制计算机通用功能，如创建和编辑照片、视频、PDF 等，控制 Chrome 浏览器进行研究，绘图分析大型数据集等
可以克服其他服务限制，在本地环境中运行，并具有完全访问互联网和任何包或库的能力。

microsoft/JARVIS

Stars: 22.8k License: MIT

JARVIS 是一个连接 LLMs 与 ML 社区的系统。

探索人工通用智能（AGI）并将尖端研究传递给整个社区
提供 Easytool 以实现更简单的工具使用
发布 TaskBench 用于评估 LLMs 的任务自动化能力
支持 OpenAI 服务和 GPT-4 模型
添加了 Gradio 演示和构建了 Web API，支持 CLI 模式，并提供配置参数来调整本地端点规模

lavague-ai/LaVague

Stars: 3.0k License: Apache-2.0

LaVague 是一个使用大型动作模型框架自动生成自动化工作流的项目。

自然语言处理：理解自然语言指令以执行浏览器交互。
Selenium 集成：与 Selenium 无缝集成，用于自动化 Web 浏览器。
开源项目：基于开源项目构建，如 transformers 和 llama-index，并利用本地或远程的开源模型，确保代理透明度并与用户利益一致。
本地模型实现隐私和控制：支持像 Gemma-7b 这样的本地模型，使用户可以完全控制他们的 AI 助手并获得隐私保证。
高级 AI 技术：首先使用本地嵌入（bge-small-en-v1.5）执行 RAG 以提取最相关 HTML 片段来满足 LLM 回答查询所需。然后利用 Few-shot 学习和 Chain of Thought 来引出最相关 Selenium 代码进行操作而无需对 LLM 进行微调（Nous-Hermes-2-Mixtral -8x7B-DPO）以生成代码。

上一篇：LabVIEW老程序功能升级：重写还是改进？

下一篇：【C++集群聊天服务器（二）】｜json简单入门

热门推荐

01如何新建文件夹？电脑新建文件夹的4种方法 02GitHub 镜像站点 03国内可直接用、免费额度/永久免费的大模型API清单（含 SiliconFlow、火山、阿里、智谱、百度、Kimi、DeepSeek、DMXAPI 等）042026年7月AI圈大地震：GPT-5.6被政府限制、Claude入驻Slack、Anthropic自研芯片 052026 国产 AI 大模型横评：DeepSeek、通义千问、Kimi、文心一言、星火、豆包谁更能打？06AI 编程 IDE 全景解析 2026：Agent 全面接管开发链路 07微信历史版本含下载地址（ Windows PC | 安卓 | MAC ）及设置微信不更新 08AI科技热点日报 | 2026年07月01日 09Agnes AI 免费 API 接入指南：文本、生图、生视频，一套接口全免费 102026上半年大模型全景技术解读：推理融合、Agent 爆发与多模态统一