外观
技术索引
从理论、部署到组件、框架、应用与技能商店,把搭 Agent、跑 Agent 常用的软件与文档入口放在一起,方便对照和筛选。公开页核验:2026-08-06。
Google Research
2017 年提出 Transformer 的原始论文,现代大模型结构的共同源头。
自注意力与 Transformer 的源头论文。
Microsoft
大规模训练与推理优化库,含 ZeRO、Offload 等,方便多卡扩展。
大模型训练省显存、提吞吐,ZeRO 让更大模型训得动。
Hugging Face
开源 ML 协作与分发平台,集中托管模型、数据集和 Spaces Demo。
模型与数据集的公共货架,找权重、试推理都从这进。
Jay Alammar
图解 Attention Is All You Need,把论文拆成可扫读的结构图,适合入门对照。
用图建立直觉,比硬啃论文更快。
Andrej Karpathy
从零手写神经网络到 GPT/Tokenizer 的视频课与代码,偏直觉和可运行实现。
从零手写到能训练,把反向传播真正跑通。
NVIDIA
NVIDIA 开源的大规模 Transformer 训练参考实现与 Megatron Core 库,面向多 GPU/多机。
NVIDIA 超大模型多卡并行训练的主流路线。
PyTorch Foundation / Meta
主流深度学习框架:张量计算、自动求导、神经网络模块与 GPU 训练推理。
训练与改模型的事实标准,开源仓库大多基于它。
预训练模型的定义与加载库,覆盖文本/视觉/音频/多模态,服务推理与训练。
加载、推理、微调开源模型的事实标准库。
共 8 项