Ben-air


  • 首页

  • 分类

  • 归档

  • 标签

  • 关于

  • 搜索

准确率(Accuracy)详解

发表于 2026-06-24 | 分类于 LLM , 开发
说明 Accuracy 在 LLM 微调评估中的含义、计算方式、适用场景,及在类别不平衡与生成式分类中的局限。
阅读全文 »

混淆矩阵(Confusion Matrix)详解

发表于 2026-06-24 | 分类于 LLM , 开发
说明混淆矩阵在 LLM 微调分类评估中的作用、构建方式、可视化解读及与 Precision/Recall 的关系。
阅读全文 »

精确率、召回率与 F1 详解

发表于 2026-06-24 | 分类于 LLM , 开发
说明 Precision、Recall、F1 及 macro/micro/weighted 平均在 LLM 微调分类评估中的含义、公式、选型与局限。
阅读全文 »

BLEU 详解

发表于 2026-06-24 | 分类于 LLM , 开发
说明 BLEU 在 LLM 生成评估中的含义、n-gram 精确率计算、 brevity penalty 及在微调验收中的适用边界。
阅读全文 »

ROUGE 详解

发表于 2026-06-24 | 分类于 LLM , 开发
说明 ROUGE 系列指标(ROUGE-N、ROUGE-L)在 LLM 摘要与生成评估中的含义、计算方式及与 BLEU 的差异。
阅读全文 »

完全匹配(Exact Match)详解

发表于 2026-06-24 | 分类于 LLM , 开发
说明 Exact Match 在 LLM 问答与结构化生成评估中的定义、规范化流程、与 token F1 的区别及局限。
阅读全文 »

Math-08.泛化与正则-03.L1与L2正则化

发表于 2026-06-24 | 分类于 知识
L1/L2 正则、Ridge 与 Lasso、权重衰减及在表格学习与高维特征场景中的应用。
阅读全文 »

Math-08.泛化与正则-02.偏差方差分解

发表于 2026-06-24 | 分类于 知识
偏差-方差分解、模型容量与泛化误差的关系及在不同数据规模下的诊断思路。
阅读全文 »

大模型部署:用 Ollama 对外提供 API 服务实操

发表于 2026-06-24 | 分类于 LLM , 开发
从安装、拉取模型、启动服务到 REST/OpenAI 兼容 API 调用,说明如何用 Ollama 把本地大模型部署成可供局域网或公网访问的推理服务,并覆盖安全与常见接入方式。
阅读全文 »

SFTTrainer 详解:TRL 监督微调训练器

发表于 2026-06-24 | 分类于 LLM , 开发
系统介绍 Hugging Face TRL 库中 SFTTrainer 的定位、数据格式、损失计算、SFTConfig 关键参数、与 PEFT 集成及常见踩坑,作为模型监督微调的技术参考。
阅读全文 »
‹1…151617…94›

939 日志
108 分类
794 标签
© 2026 Ben-air
已有人访问 | 总访问次