llm.mojo
github.com原文 ↗
llm.mojo 将 llm.c 的训练实现移植到 Mojo,并加入 Metal kernels,面向 Apple GPU/MPS 路径做实验。HN 摘要给出的性能点是相对 PyTorch MPS 快 1.72x,项目重点是小型 GPT 训练栈而不是通用推理框架。它适合关注 Mojo、Metal 和轻量训练内核的人读,因为这里的工程问题集中在内存布局、kernel 和训练循环上。
–浏览
github.com原文 ↗
评论 · Comments