proto.lib

Tối ưu đồ thị ONNX: constant folding & fusion

Sau khi export model sang đồ thị portable (ONNX), runtime duyệt lại đồ thị: gộp hằng số đã tính trước (constant folding), hợp nhất chuỗi Conv+BN+ReLU hoặc MatMul+Add+GELU thành một kernel để giảm round-trip bộ nhớ, rồi chọn execution provider phù hợp cho từng node trước khi ship.

AI/ML SystemsTrung bình2026-08-20
Tối ưu đồ thị ONNX: constant folding & fusion

Liên quan