TensorRT 自学笔记001 基础知识点和学习资源

互联网 1 年前 0 3

本文介绍: TensorRT 是一套可用于高效实现DL模型推理的SDK，它内含infer优化器和运行环境，能让DL模型在更低的资源占用的条件下，以更快的的运行。在TensorRT中，我们可以用API手动地一个Layer一个Layer地搭建Network，也可以直接使用来自ONNX的模型，如果使用后者，就不需要一层一层地搭建模型。

各位大佬，这是我的自学笔记，如有错误请指正，也欢迎在评论区学习交流，谢谢！

TensorRT 是一套可用于高效实现DL模型推理的SDK，它内含infer优化器和运行环境，能让DL模型在更低的资源占用的条件下，以更快的的运行。在TensorRT中，我们可以用API手动地一个Layer一个Layer地搭建Network，也可以直接使用来自ONNX的模型，如果使用后者，就不需要一层一层地搭建模型。

Jetpack SDK
TensorRT文档
 C++ API文档
 Python API
TensoRT 下载
 B站课程示例代码
 B站官方课程链接

加载模型，并优化模型，计算图优化，将多个层合并为一个层，消除无用层，导入用户自定义的plugin（可选）
注：上述这些操作都是为了，加快模型的推理速度，同时降低模型的资源消耗（CPU资源，内存资源）。

维护运行环境，然后序列化和反序列化engine

下面是一些名词和功能的解释

显示所有内容

声明：本站所有文章，如无特殊说明或标注，均为本站原创发布。任何个人或组织，在未征得本站同意时，禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。如若本站内容侵犯了原著者的合法权益，可联系我们进行处理。

dl tensorrt 模型

相关文章

transformer剪枝论文汇总

transformer剪枝论文汇总

互联网 1 年前 4

使用deepspeed继续训练LLAMA

使用deepspeed继续训练LLAMA

互联网 1 年前 3

【人工智能】Fine-tuning 微调：解析深度学习中的利器(7)

【人工智能】Fine-tuning 微调：解析深度学习中的利器(7)

互联网 1 年前 6

GPT-4模型中的token和Tokenization概念介绍

GPT-4模型中的token和Tokenization概念介绍

互联网 1 年前 7

Linux 网络编程 + 笔记

Linux 网络编程 + 笔记

linux 1 年前 2

【成品论文】2024美赛B题完整成品论文23页+3小问matlab代码+数据集汇总

【成品论文】2024美赛B题完整成品论文23页+3小问matlab代码+数据集汇总

互联网 1 年前 3

JVM之GC垃圾回收

互联网 1 年前 3

行为型设计模式—中介者模式

互联网 1 年前 4

发表回复取消回复