Triton 编译器源码级实战
沿 Python DSL → AST → TTIR → TTGIR → LLVM IR/PTX 的多级 lowering 链路拆解 Triton 编译器,并亲手 dump 各级 IR 观察 fused softmax kernel 的编译全过程。
沿 Python DSL → AST → TTIR → TTGIR → LLVM IR/PTX 的多级 lowering 链路拆解 Triton 编译器,并亲手 dump 各级 IR 观察 fused softmax kernel 的编译全过程。
拆解 torch.compile 三驾马车与 MLIR 多级 Dialect 下沉机制,打通「Python 模型代码 → IR → 硬件 kernel」的编译链路认知。
手写并注册一个经典 LLVM Pass、从零自研一个完整 MLIR Dialect(Op/Verifier/Lowering),并亲手编译 LLVM 跑通 Pass 验证语义不变——打通 AI 编译器的最后一公里。
站在编译器与硬件抽象的视角,构想下一代 AI Infra 的终极工程形态——具 HAL 能力的统一 IR、AI-First 智能编译器与跨平台 LLM-Native 编译框架,并以一份「统一 IR 设计」技术 RFC 收束全站之旅。