来源:Sebastian Raschka 技术专栏(LLM 与深度学习工程)|作者 Sebastian Raschka|站点 https://magazine.sebastianraschka.com/|原文链接:https://magazine.sebastianraschka.com/
很多讲 AI 的内容在追"又发了什么新模型",Sebastian Raschka 的专栏反着来——他专写"这篇方法我亲手跑通了、坑在哪、你怎么复现"。对只想从"看懂论文"升级到"会做实验"的人,这份站点几乎是必看。
为什么值得读,三个收获点:第一,他的文章几乎都带可运行代码和实验数据,而不是停在概念,你能照着把结果跑出来,这点对自学者太关键;第二,他特别擅长把复杂的训练细节(如 LoRA、蒸馏、推理优化)拆成"为什么这么做、不这么做会怎样",比干读论文省力;第三,他常做横向对比实测,帮你判断"这项技术到底值不值得上车"。一句话金句:他信的是"能复现的理解,才是真理解"。
适配谁看:做 LLM 微调/训练的工程师、转行做 AI 的研究生,以及所有"论文看得懂、手却不会动"的人。
编辑补充:他的例子偏英文、偏代码,落地时可以配合本站收录的 Hugging Face、Qwen 这类开源生态边读边练——专栏给你方法,开源社区给你不用从零造轮子的入口,搭着学最快。