01
AI 工程
训练、推理、任务调度与可观测性,从系统视角理解 AI 基础设施。
INFRASTRUCTUREWHAT I WRITE ABOUT
不追逐信息流,沉淀可以重复使用的判断和方法。
01
训练、推理、任务调度与可观测性,从系统视角理解 AI 基础设施。
INFRASTRUCTURE02
CUDA、TensorRT 与性能分析,关注每一次抽象背后的真实开销。
PERFORMANCE03
Agent、工具链与工程工作流,让经验变成团队和个人的复利。
DEVELOPER EXPERIENCESELECTED WRITING
从底层机制出发,记录问题是怎样被理解和解决的。
很多训练平台都从一个表单开始:选择镜像、填写启动命令、申请几张 GPU,然后点击“提交”。
cudaNvSci
clock
asyncAPI
```c++nvinfer1::IPluginV2* importPluginFromRegistry(IImporterContext* ctx, const std::string& plug...
KEEP THINKING IN PUBLIC