llama_index

染指11103 天前
rag·llama_index·llamaindex
70.高级RAG-混合检索器(BM25和向量检索,RRF、归一化分数、DBSF公式详解,融合排序)内容参考于:图灵AI大模型全栈检索器是用来从知识库或向量数据库中查找相关文本的东西,然后再交给大语言模型生成答案
染指111010 天前
人工智能·llama_index·llamaindex·摄取管道
64.高级RAG-摄取管道内容参考于:图灵AI大模型全栈摄取管道现在有这样的一件事情,有一个文档A用户上传了一次,B用户上传了一次,一个文档上传了两次这种情况要做两次RAG的知识库吗?这里就有两个概念 全量更新和增量更新
染指111014 天前
人工智能·llama·rag·llama_index·llamaindex
61.RAG-RAG存在的问题内容参考于:图灵AI大模型全栈RAG它实际上存在一些问题,需要考虑这些问题该怎样解决RAG的流程1.加载文件
染指111019 天前
人工智能·llama·rag·llama_index·llamaindex
56.llama_index-查询引擎内容参考于:图灵AI大模型全栈查询引擎Query Engine(查询引擎)它在llamaindex中是最常用的一个抽象接口,用来接收问题,自动完成检索相关文档片段(Node)然后调用llm大模型生成最终答案,只需要一行代码就可以实现
染指111022 天前
数据库·redis·llama_index·llamaindex
53.llama_index-向量存储、索引存储内容参考于:图灵AI大模型全栈向量存储是VectorStore官网地址:https://developers.llamaindex.ai/python/framework-api-reference/storage/vector_store/
染指11101 个月前
llama·llama_index
44.llama_index-向量模型的使用(在线和本地)内容参考于:图灵AI大模型全栈在线模型这里还是使用千问的模型,下载指令如下执行完指令,如下图红框就有了千问的模型
leo03082 年前
llm·llama·ollama·llama_index
解决llama_index中使用Ollama出现timed out 问题现象:代码:解决办法是增加timeout时长
luxinfeng6663 年前
embedding·embedding微调·大模型微调·llama_index·自定义微调
基于llama-index对embedding模型进行微调QA对话目前是大语言模型的一大应用场景,在QA对话中,由于大语言模型信息的滞后性以及不包含业务知识的特点,我们经常需要外挂知识库来协助大模型解决一些问题。在外挂知识库的过程中,embedding模型的召回效果直接影响到大模型的回答效果,因此,在许多场景下,我们都需要微调我们的embedding模型来提高我们的召回效果。下面,我们就基于llama-index对BAAI/bge-base-zh-v1.5模型进行微调,关于该模型的介绍,可以参考https://huggingface.co/BAAI/bge-ba
我是有底线的