抗体:可变区结构 发表于 2026-05-29 | 更新于 2026-08-28 | 分类于 生物信息 , 抗体 从免疫球蛋白折叠、FR/CDR 分区、V(D)J 胚系片段来源、VH–VL 配对界面到六条 CDR 环的空间排布,系统对比重链与轻链可变区的结构异同;配图对照 Chothia 拓扑与 Fab 晶体统计。 阅读全文 »
进化策略 发表于 2026-05-29 | 更新于 2026-08-28 | 分类于 机器学习 , 强化学习 进化策略 ES:OpenAI ES、CMA-ES、PBT;黑盒优化、与策略梯度的对比及适用场景。 阅读全文 »
模仿与逆强化学习 发表于 2026-05-29 | 更新于 2026-08-28 | 分类于 机器学习 , 强化学习 模仿学习与逆强化学习:Behavior Cloning、DAgger、MaxEnt IRL、GAIL;专家演示、协变量偏移与奖励推断。 阅读全文 »
多智能体RL 发表于 2026-05-29 | 更新于 2026-08-28 | 分类于 机器学习 , 强化学习 多智能体强化学习 MARL:随机博弈、CTDE、MADDPG、QMIX、MAPPO/IPPO;协作与竞争及非平稳性挑战。 阅读全文 »
项目Checklist 发表于 2026-05-28 | 更新于 2026-08-28 | 分类于 机器学习 , 强化学习 RL 项目立项到上线 Checklist;CartPole POC 走查 Notebook 与各案例交付物对照。 阅读全文 »
Sim2Real 发表于 2026-05-28 | 更新于 2026-08-28 | 分类于 机器学习 , 强化学习 真实案例:单关节力矩控制 Sim2Real;域随机化 Notebook、难点与 IL+护栏方案对比。 阅读全文 »
调度仿真 发表于 2026-05-28 | 更新于 2026-08-28 | 分类于 机器学习 , 强化学习 真实案例:生信 WGS/RNA-seq 集群作业调度;Q-Learning vs FIFO、难点与 bioinfo_cluster_scheduling.ipynb。 阅读全文 »
推荐与Bandit 发表于 2026-05-28 | 更新于 2026-08-28 | 分类于 机器学习 , 强化学习 真实案例:App 信息流广告位推荐;MAB/UCB 落地、难点与 bandit_news_recommendation.ipynb。 阅读全文 »
长度选型-19bp与21mer 发表于 2026-05-28 | 更新于 2026-08-28 | 分类于 生物信息 , siRNA 以「配对区碱基数 + 3' 突出端 nt 数」的 19+2 与 21+2 两种主流写法为主线,说明各自结构、优劣、临床与研究使用场景及选型决策流程。 阅读全文 »
CartPole到MuJoCo 发表于 2026-05-28 | 更新于 2026-08-28 | 分类于 机器学习 , 强化学习 真实案例:倒立摆/AGV 平衡控制;CartPole→LunarLander→MuJoCo 渐进路线、落地难点与 ipynb 实战。 阅读全文 »