Milvus单机模式安装和试用

1.安装ollama的package包;

复制代码
# install package
pip install -U langchain-ollama

2.我们直接使用ChatOllama实例化模型,并通过invoke进行调用;

复制代码
from langchain_ollama import ChatOllama

llm = ChatOllama(model="deepseek-r1")
messages = [
    ("system", "你是一个很有用的翻译助手,请将以下句子翻译成英语。"),
    ("human", "我爱编程。")
]
message = llm.invoke(messages)
print(message.content)

3.通过流式方式调用大模型;

复制代码
from langchain_ollama import ChatOllama

msgs = [
    ("human", "LLM是什么?")
]
llm = ChatOllama(model="deepseek-r1")
for chunk in llm.stream(msgs):
    print(chunk.content, end='')

4.我们可以直接使用chain链接prompt和llm进行调用;

复制代码
from langchain_ollama.chat_models import ChatOllama
from langchain_core.prompts import ChatPromptTemplate

prompt = ChatPromptTemplate.from_messages(
    [
        (
            "system",
            "你是一个很有帮助的翻译助手,请将用户的输入从{input_language}成{output_language}"
        ),
        (
            "human",
            "{input}"
        )
    ]
)

llm = ChatOllama(model="deepseek-r1")
chain = prompt | llm
msg = chain.invoke(
    {
        "input_language":"中文",
        "output_language":"英文",
        "input":"我爱编程。"
    }
)
print(msg.content)

5.通过tool标记函数,并使用bind_tools来绑定函数,来实现tools的调用;

复制代码
from typing import List

from langchain_ollama import ChatOllama
from langchain_core.tools import tool

    # """校验用户的历史住址.

    # Args:
    #     user_id (int): 用户的id.
    #     addresses (List[str]): 以前居住的地址列表.
    # """

@tool
def validate_user(user_id: int, addresses: List[str]) -> bool:
    """Validate user using historical addresses.

    Args:
        user_id (int): the user ID.
        addresses (List[str]): Previous addresses as a list of strings.
    """

    return True

llm = ChatOllama(model="qwen3:0.6b").bind_tools([validate_user])
result = llm.invoke(
    "请校验一下用户123,他以前在"
    "河南省郑州市和"
    "北京市西城区住过"
)
print(result.tool_calls)
相关推荐
小田学Python1 天前
重新定义 Agent:为什么大模型不能直接干活,需要一层“壳”
大模型·api·ai agent
张彦峰ZYF1 天前
LangGraph 深入理解 ReAct:让 AI Agent 真正学会「边想边做」
人工智能·llm·agent·react·langgroup
想要成为糕糕手1 天前
🚀 在浏览器里跑 DeepSeek-R1?WebGPU 端侧推理实战(六)—— 完结篇:消息渲染与流式收尾
react.js·typescript·llm
白拾1 天前
【arXiv 2026】Nemotron-Labs-Diffusion:三模式语言模型 统一自回归、扩散与自推测解码|从大模型推理加速视角
大模型·推理加速·扩散语言模型·并行解码·自推测解码·arxiv 2026
dozenyaoyida1 天前
AI与大模型新闻日报 | 2026-08-13
人工智能·ai·大模型·新闻
AndrewHZ1 天前
【LLM技术全景】RAG 从原理到实战——检索增强生成完整指南
人工智能·深度学习·算法·llm·检索增强·生成式模型·rag
thesky1234561 天前
27届大模型面试准备(二十九):长文本推理与高效注意力——FlashAttention、稀疏/线性注意力与推理侧长度外推
大模型·面试准备·flashattention·推理优化·稀疏注意力·长文本推理·长度外推
liulilittle1 天前
DeepSeek Harness 自定义模型提供商配置
前端·javascript·人工智能·windows·llm·deepseek·harness
tachibana21 天前
文件上传分布式限流如何做?
人工智能·ai·大模型·llm·prompt