上线一周收获2K star,仅500行代码实现AI增强搜索引擎

这个项目刚刚发布便登上GitHub热榜首位,短短一周便收获了惊人的2K star,背后的团队更是备受热议,今天的开源项目就是AI搜索引擎:lepton search

Lepton Search的一些背景

Lepton Search 是有LeptonAI 推出的 ai增强对话式搜索引擎,可以说从发布出来的那一天,就备受关注和争议。

首先要说不是产品,而是LeptonAI的CEO 贾扬清。如果是关注AI圈子的人 ,一定对这个名字不陌生了,先是贾扬清发表的朋友圈,怒喷了一把国内某些大厂的大模型抄袭,当时一度爆火。

再说回产品,在1月25日Lepton AI 发布了一个小demo,当时Lepton Search 还没有正式开源。在发布之后,号称要干掉谷歌搜索的 Perplexity 创始人声称 LeptonAI 在"借鉴"、"致敬"他们的产品。作为 LeptonAI 的创始人,贾扬清在 Twitter 上进行了公开回击,并且明确说,要开源Lepton Search 。

现在Lepton Search 正式开源后,关注度更是持续升温。

Lepton Search 是什么

贾扬清在自己的团队记录里提到,这只是一个demo,仅用了一个周末的时间来演示AI应用容易实现。以下它目前的能力:

  • 对 LLM 的内置支持
  • 内置搜索引擎支持
  • 可定制漂亮的UI界面
  • 可共享的缓存搜索结果

Lepton Search之所以500行代码就能实现,依赖的是它背后已经模块化的AI能力,这里Lepton Search之所以核心使用到的能力有3块:

  • 大模型,调用了在LeptonAI自家云上部署的开源Mixtral-8x7b模型。
  • 搜索引擎,目前用了必应搜索的API。
  • 数据存储,用自家Lepton KV作为无服务器存储。

所以Lepton Search 是一个前端UI加接口调度的组合。但是这也给所有开发者一个借鉴,未来的AI应用开发将愈来愈模块化。

使用 Lepton Search

项目提供了在线试用:

search.lepton.run/

当然也可以自己来编译部署,以下几步:

首先需要获取bing的key,设置为变量

ini 复制代码
export BING_SEARCH_V7_SUBSCRIPTION_KEY=YOUR_BING_SUBSCRIPTION_KEY

编译web

arduino 复制代码
cd web && npm install && npm run build

启动服务

ini 复制代码
BACKEND=BING python search_with_lepton.py

AI增强搜索引擎

目前,大语言模型(LLM)主要面临两大挑战:数据陈旧、偶发幻觉。由于基础模型所使用的预训练数据集具有明确的截止日期,因此无法根据最新数据做出响应。即使是当前最强大的模型,也往往会因数据过时而编造答案,也就是人们常说的"幻觉"问题。

对于无法访问最新数据,可以有两种方法,第一种是通过搜索引擎,通过执行网络搜索并向大模型提交输来改善决策质量。

第二种方法是,通过所谓检索增强生成(RAG),这项成熟技术可以解决一定程度的"幻觉"问题。与前面提到的动态调用搜索 API 方法不同,RAG 强调从公开数据存储中检索数据,例如向量数据库或者由外部维护的全文搜索索引等。

项目信息

  • 项目名称:Lepton Search
  • GitHub 链接:search_with_lepton
  • Star 数:2K+
相关推荐
梦云澜3 分钟前
论文阅读(十二):全基因组关联研究中生物通路的图形建模
论文阅读·人工智能·深度学习
远洋录31 分钟前
构建一个数据分析Agent:提升分析效率的实践
人工智能·ai·ai agent
IT古董2 小时前
【深度学习】常见模型-Transformer模型
人工智能·深度学习·transformer
沐雪架构师2 小时前
AI大模型开发原理篇-2:语言模型雏形之词袋模型
人工智能·语言模型·自然语言处理
python算法(魔法师版)3 小时前
深度学习深度解析:从基础到前沿
人工智能·深度学习
kakaZhui4 小时前
【llm对话系统】大模型源码分析之 LLaMA 位置编码 RoPE
人工智能·深度学习·chatgpt·aigc·llama
struggle20255 小时前
一个开源 GenBI AI 本地代理(确保本地数据安全),使数据驱动型团队能够与其数据进行互动,生成文本到 SQL、图表、电子表格、报告和 BI
人工智能·深度学习·目标检测·语言模型·自然语言处理·数据挖掘·集成学习
佛州小李哥5 小时前
通过亚马逊云科技Bedrock打造自定义AI智能体Agent(上)
人工智能·科技·ai·语言模型·云计算·aws·亚马逊云科技
云空6 小时前
《DeepSeek 网页/API 性能异常(DeepSeek Web/API Degraded Performance):网络安全日志》
运维·人工智能·web安全·网络安全·开源·网络攻击模型·安全威胁分析
AIGC大时代6 小时前
对比DeepSeek、ChatGPT和Kimi的学术写作关键词提取能力
论文阅读·人工智能·chatgpt·数据分析·prompt