深度学习推理框架汇总

深度学习推理框架汇总

  • TensorFlow Serving:TensorFlow Serving 是 TensorFlow 的官方模型服务框架,专门用于部署 TensorFlow 模型。它提供了高性能、可扩展、灵活的模型部署和推理服务。

  • TorchServe:TorchServe 是 PyTorch 官方推出的模型服务框架,用于部署 PyTorch 模型。它支持灵活的模型部署、动态扩缩容、模型版本控制等功能。

  • ONNX Runtime:ONNX Runtime 是一个高性能的推理引擎,专门用于执行 ONNX 格式的模型。它支持跨平台部署,包括 CPU、GPU、移动设备等,并提供了 C++、Python 和 Java 等多种语言的 API。

  • TensorRT:TensorRT 是 NVIDIA 推出的高性能推理引擎,专门针对 NVIDIA GPU 进行了优化。它支持对 TensorFlow、PyTorch、ONNX 等模型进行优化和部署。

  • OpenVINO (Open Visual Inference & Neural Network Optimization):OpenVINO 是英特尔推出的深度学习推理工具包,支持针对英特尔 CPU、GPU、VPU(Vision Processing Unit)等硬件进行优化的推理。

  • TensorRTX:TensorRTX 是英伟达推出的一款基于 TensorRT 的深度学习推理框架,提供了更多的优化和扩展功能,适用于高性能和低延迟的推理需求。

  • NCNN (NVIDIA CUDA Convolutional Neural Networks):NCNN 是一个高效的深度学习推理框架,专门针对移动端和嵌入式设备进行了优化,支持多种硬件平台。

  • MNN (Mobile Neural Network):MNN 是阿里巴巴推出的移动端深度学习推理引擎,支持多种模型格式,并且适用于 Android、iOS 等移动设备。

相关推荐
阿正的梦工坊9 分钟前
TruthfulQA 数据集介绍与使用指南:中英双语
人工智能·深度学习
IT古董17 分钟前
【漫话机器学习系列】006.AUC值(Area Under The Curve)
人工智能·机器学习
寒暄喆意30 分钟前
智慧农业物联网解决方案:道品科技水肥一体化
大数据·人工智能·科技·物联网
电子科技圈40 分钟前
ICCAD 2024新趋势:IP企业携手为汽车和桌面等热点应用打造联合IP解决方案
大数据·人工智能·科技·嵌入式硬件·车载系统·汽车·智能硬件
SQingL1 小时前
深度学习中,卷积层的若干思考!!!
人工智能·深度学习·机器学习
声网1 小时前
OpenAI Realtime API 升级,集成 WebRTC 且降价 60%;豆包发布视觉理解模型,实时语音模型也将上线
人工智能
PowerBI学谦1 小时前
使用 Copilot 增强创造力:Mighty Media 的卓越数字化之旅
人工智能·copilot
凡人的AI工具箱3 小时前
每天40分玩转Django:Django缓存系统
人工智能·后端·python·缓存·django·ai编程
Aileen_0v03 小时前
【设计模式探索——智能遍历:如何用迭代器模式优化AI数据处理】
java·人工智能·设计模式·迭代器模式
葡萄月令with蒲公英3 小时前
深度学习常见名词概念:Sota、Benchmark、Baseline、端到端模型、迁移学习等的定义
人工智能·深度学习·迁移学习