Ben-air
首页
分类
归档
标签
关于
搜索
大模型
分类
学习率与 warmup:控制步长,前期爬坡防炸
08-26
Weight decay:每步把过大权重拉向零
08-26
RMSNorm:无均值归一,LLaMA 系默认
08-26
LayerNorm:稳住激活尺度,让深层可训
08-26
Dropout:训练时随机失活,抑制过拟合
08-26
大模型算法要点:开关与剂量的宏观导读
08-26
MCP开发:实战-配置化Pipeline的MCP改造与扩容
07-28
MCP开发:鉴权与安全验证
07-27
DLP-Affinity:整体结构说明
07-20
RFdiffusion3:架构与训练全景
07-15
AbAffinity:框架架构与使用
07-06
Unsloth 详解:LoRA/QLoRA 训练加速
06-30
Axolotl 详解:YAML 配方与多卡微调
06-30
ms-swift 详解:魔搭 SWIFT 微调与部署
06-30
LLaMA-Factory 详解:YAML 与 WebUI 微调工厂
06-30
1
2
…
9
›