Ben-air
首页
分类
归档
标签
关于
搜索
大模型
分类
微调框架横向对比:SFTTrainer、LLaMA-Factory、ms-swift、Axolotl、Unsloth
06-30
灾难性遗忘与微调版本管理
06-30
训练加速:Unsloth 与 Liger Kernel
06-30
分布式微调:DDP、DeepSpeed 与 FSDP
06-30
GRPOTrainer 详解:可验证奖励与组相对优化
06-30
微调数据混合与课程学习
06-29
微调前后基线评估
06-29
微调显存优化栈
06-29
DPOTrainer 详解:TRL 直接偏好优化
06-29
全参微调与 PEFT 选型
06-29
监督微调 SFT 与指令微调
06-29
继续预训练 CPT 与领域适配
06-29
Adapter 合并、多 LoRA 与续训
06-29
PEFT 方法横向对比:LoRA、AdaLoRA、DoRA、IA³
06-29
QLoRA 与量化微调
06-29
‹
1
2
3
…
9
›