📚 Wiki 知识库

🏷️ PyTorch

6 篇

OpenRLHF 作者发布 Agentic RL 框架 Molt:9K 行核心代码支持超大规模 MoE 训练

OpenRLHF 作者发布了新的强化学习框架 Molt。该框架采用纯 PyTorch 栈,核心代码仅约 9000 行,专注于 Agentic RL 研究。它支持 Qwen3.5-397B 到 GLM-5.2 753B 等超大规模 MoE 模型训练,无需依赖 Megatron,具备高度的代码可读性和可修改性。

技术LLM ✍ 青稞社区🕐 2026-07-16

PyTorch 训练流程速查表

这是一份关于 PyTorch 训练流程的单页速查表。文章通过代码示例和原理解析,深入浅出地讲解了张量的核心概念、矩阵乘法、自动求导机制、反向传播以及梯度下降优化过程。同时涵盖了 `nn.Module` 常用组件如 Linear、ReLU 和 GELU 的使用,旨在帮助开发者快速理解深度学习引擎的运作原理。

技术编程语言 ✍ kozue🕐 2026-07-03

机器学习大神批判高校 AI 教学:fast.ai 的自顶向下革命

文章批判了当前大学 AI 教育重理论轻实践、先筑高数门槛的弊端,认为这应像学骑车一样先上手。介绍了机器学习大神推出的免费课程 fast.ai,采用“自顶向下”教学法,首节课即通过实战让模型上线,强调产品交付能力优于学术头衔,旨在打破学术精英主义,普及实用技能。

技术LLM ✍ 墓碑科技🕐 2026-07-02

AI/ML 所需的线性代数知识(完整路线图)

本文旨在消除从事 AI/ML 工作对数学博士学位的恐惧,提供了一份精准的线性代数学习路线图。文章分为五个阶段:从标量、向量、矩阵等基础概念,到特征值、SVD(奇异值分解)等核心机器学习数学工具,再到连接微积分的梯度与雅可比矩阵。作者强调了掌握这些概念对于理解神经网络、PCA、推荐系统及 LoRA 微调等技术的重要性。

技术LLM ✍ vixhaℓ🕐 2026-04-24

900万参数,130行代码:从零构建微型语言模型 GuppyLM 教程

本文介绍了开发者 arman-bd 开源的微型语言模型 GuppyLM。该模型拥有 900 万参数,核心代码仅 130 行,可在免费 Colab 上 5 分钟训练完成。文章详细拆解了构建流程:利用模板生成 6 万条合成数据、训练 4096 词表的 BPE 分词器、搭建 6 层 Vanilla Transformer 架构以及优化推理环节。该项目旨在通过极简的实现,帮助开发者深入理解语言模型的数据工程、架构设计与训练循环。

技术LLM ✍ Jason Zhu🕐 2026-04-07