Mini-Infer (27): 运行时架构重构 (下) — ExecutionContext 与零拷贝执行
Mini-Infer (26): 运行时架构重构 (上) — InferencePlan 与 Build-Time 优化
Mini-Infer (25): 动态形状的基石 — `OptimizationProfile` 设计与实现
Mini-Infer (24): 动态形状支持 — 运行时形状推理引擎
Mini-Infer (23): 内存优化的黑魔法 — 静态内存规划与贪心着色
Mini-Infer (22): 架构重构 — 链接器的魔法与“副作用”驱动的自动注册
Mini-Infer (21): 图优化实战 — TensorRT 风格的 `FusionPass` 与延迟删除
Mini-Infer (20): 优化器的骨架 — `Pass Manager` 架构设计
Mini-Infer (19): 内置算子导入实战 — Conv, ReLU, Pooling 与 Flatten
Mini-Infer (18): 编排导入流程 — `ModelImporter` 与 `AttributeHelper`
Mini-Infer (17): 深入字节流 — `WeightImporter` 与权重加载
Mini-Infer (16): 模型导入的核心 — `ImporterContext` 与 `OperatorRegistry`
Mini-Infer (15): `OnnxParser` 架构设计
Mini-Infer (14): 迈向 ONNX — `Flatten` 算子与零拷贝视图
Mini-Infer (13): 端到端验证 — LeNet-5 实战与 PyTorch 对齐
Mini-Infer (12): 特征提取的收缩 — `Pooling` 算子与架构复用
avatar
James He
#远离喧嚣 向野而生#
Follow Me
公告
当你穿过了暴风雨,你就不再是原来的那个人了
充实每一天