从零开始学 AI Infra:课程、论文与开源资源全景学习笔记
从零开始学 AI Infra 的全景路线图:前置知识、CUDA 与算子优化、分布式训练、推理与部署四层架构,配齐 MIT/CMU/Stanford 名校课程、必读论文、vLLM/DeepSpeed 等开源项目与中文社区优质资料。
从零开始学 AI Infra 的全景路线图:前置知识、CUDA 与算子优化、分布式训练、推理与部署四层架构,配齐 MIT/CMU/Stanford 名校课程、必读论文、vLLM/DeepSpeed 等开源项目与中文社区优质资料。
Karpathy《Let's build GPT: from scratch, in code, spelled out.》完整学习笔记:从 bigram 基线到自注意力、多头注意力、Transformer Block 与完整 GPT 模型的逐行拆解。
把 Andrej Karpathy 的《Let's build the GPT Tokenizer》(2h13m)变成 15 章中文笔记只花了半小时——这篇复盘"检索 → 交叉验证 → 结构化输出"的公开课笔记工作流,并把整套流程固化成可直接复用的 skill。
Karpathy《Let's build the GPT Tokenizer》完整学习笔记:从字符级分词、UTF-8 与字节级 BPE 算法、正则预分词、特殊 Token,到 SentencePiece 与各种 LLM 怪癖的 tokenization 根源。
从零到上线只花了一个下午——这篇记录 agent 帮我搭博客的全过程:设计复刻、三个经典坑、GitHub 故障日的破局,以及我把整套经验固化成 skill 的姿势。
把吃灰的 3090 变成私有 LLM 服务:vLLM + OpenWebUI 一条龙,告别 API 限流,token 想用多少用多少。
MCP(Model Context Protocol)让 AI 从「聊天」进化成「干活」。这篇文章记录我把在线 Markdown 编辑器接入 MCP Server 的全过程。
攻防演练的起点永远是侦察。这篇文章复盘一次针对公网 IP 段的端口扫描,以及暴露面收敛的实操清单。
从想法到上线只花了 24 小时:Next.js + Cloudflare Pages + Stripe 的出海建站模板,我把它开源了。