深度学习基础-onnxruntime推理模型

以下是一个完整的示例,展示如何加载 ONNX 模型、获取模型信息并运行推理:

复制代码
import onnxruntime
import numpy as np

# 模型路径
bev_head_onnx_path = "path/to/your/bev_head.onnx"

# 加载模型
session = onnxruntime.InferenceSession(bev_head_onnx_path)

# 获取模型元信息
model_meta = session.get_modelmeta()
print("Model Name:", model_meta.name)
print("Model Version:", model_meta.version)
print("Inputs:", [input.name for input in model_meta.graph_inputs])
print("Outputs:", [output.name for output in model_meta.graph_outputs])

# 准备输入数据
# 假设模型的输入名称为 'volumes',形状为 (1, 3, 224, 224)
volumes = np.random.rand(1, 3, 224, 224).astype(np.float32)

# 运行推理
onnx_results = session.run([], {'volumes': volumes})

# 打印输出结果
print("Output shape:", [result.shape for result in onnx_results])

输出示例

假设模型的输入名称为 'volumes',输出名称为 'output',运行上述代码可能会输出类似以下内容:

复制代码
Model Name: bev_head_model
Model Version: 1.0
Inputs: ['volumes']
Outputs: ['output']
Output shape: [(1, 1000)]

注意事项

  1. 输入名称和形状

    • 输入数据的名称(如 'volumes')和形状必须与 ONNX 模型中定义的输入一致。可以通过 get_modelmeta() 检查输入名称和形状。

    • 如果输入数据的形状不正确,可能会导致运行时错误。

  2. 数据类型

    • 输入数据的类型(如 np.float32)也必须与模型的要求一致。可以通过 model_meta.graph_inputs 检查输入数据类型。
  3. 输出结果

    • session.run() 返回的结果是一个列表,其中每个元素对应一个输出张量。如果模型有多个输出,可以通过指定输出名称列表来选择需要的输出。
  4. 性能优化

    • 如果需要更高的推理性能,可以使用 onnxruntime 的优化选项,例如设置执行提供者(如 CUDAExecutionProvider)或启用图优化。

通过这种方式,你可以方便地加载和运行 ONNX 模型,并获取模型的推理结果。

相关推荐
QCodingDev几秒前
Spring AI Alibaba ReAct Agent实战:从Tool Calling到Agent,企业AI复杂业务该如何设计?
java·人工智能·agent·ai编程·spring ai
秦先生在广东几秒前
GitHub Spec Kit:用「先写规格后写代码」重新定义 AI 辅助开发
人工智能
Leslie1653 分钟前
柱子只进栈一次为何能算最大矩形:单调栈逐步可视化
人工智能
两万五千个小时4 分钟前
DeepSeek Harness 的动力引擎:Agent Loop 是怎么转起来的
人工智能·程序员·架构
AI轻职场8 分钟前
#DeepSeek、Qwen、GLM 都在卷 Coding,Java 开发者真正应该学什么?
人工智能
Leslie16510 分钟前
注意力不是全连接层换名字:多头自注意力的张量实验
人工智能
Postkarte不想说话10 分钟前
vLLM自定义对话模板
人工智能
具身AGI10 分钟前
宇树打新:物理AI 国产的「本体」先跑通了商业化
人工智能
Json____11 分钟前
AI内容创作平台项目源码
人工智能·ai·agent·内容创作·wwwoop.com
Jay-r13 分钟前
DeepSeek Harness 极简上手:装好、玩熟、让它自己长新能力
人工智能·windows·ai·github·ai编程·deepseek·harness