Ben-air


  • 首页

  • 分类

  • 归档

  • 标签

  • 关于

  • 搜索

大模型分类

学习率与 warmup:控制步长,前期爬坡防炸

08-26

Weight decay:每步把过大权重拉向零

08-26

RMSNorm:无均值归一,LLaMA 系默认

08-26

LayerNorm:稳住激活尺度,让深层可训

08-26

Dropout:训练时随机失活,抑制过拟合

08-26

大模型算法要点:开关与剂量的宏观导读

08-26

MCP开发:实战-配置化Pipeline的MCP改造与扩容

07-28

MCP开发:鉴权与安全验证

07-27

DLP-Affinity:整体结构说明

07-20

RFdiffusion3:架构与训练全景

07-15

AbAffinity:框架架构与使用

07-06

Unsloth 详解:LoRA/QLoRA 训练加速

06-30

Axolotl 详解:YAML 配方与多卡微调

06-30

ms-swift 详解:魔搭 SWIFT 微调与部署

06-30

LLaMA-Factory 详解:YAML 与 WebUI 微调工厂

06-30
12…9›

1034 日志
49 分类
917 标签
© 2026 Ben-air
已有人访问 | 总访问次