Skip to content
智体通鉴 · AgentGuide
Main Navigation
办公与创意
工业 Agent
技术索引
学习成长
关于
关于本站
更新日志
隐私政策
内容协作
支持我们
外观
菜单
回到顶部
本页目录
微调与对齐
SFT / PEFT / LoRA / RLHF / 中文适配与数据构建
返回
面试问答总览
。
LLM微调实战
参数高效微调PEFT
LoRA详解
强化学习RLHF
增量预训练
RLHF变种与PPO详解
LoRA高效微调技术指南
PEFT框架LoRA源码剖析
大模型领域知识增强
预训练数据拼接策略
LLaMA2中文适配训练
强化学习与RLHF对齐技术概览
RLHF训练流程与对齐替代方案
PPO算法在大模型RLHF中的应用
强化学习NLP应用基础
大模型训练数据构建与微调策略
LLM自动生成SFT数据方法
英文LLM中文支持之Tokenization构建
英文LLM中文适配之继续预训练
英文LLM中文适配之指令微调
预训练数据与SFT训练参数策略