跳到主要内容

TAG / K

可复现性

kefuxianxing·1 篇笔记·结果可被稳定复现

AI / Skill

SkillOpt: 把 skill 文档当参数来训练, 以及它在规范与可复现性上的边界

NOTE 如果一份 skill 文档写得不好, 为什么不能像调参一样把它"训"好? SKILL.md 是纯文本, 模型权重可以冻结, 任务分数就是现成的损失函数 —— 这条路听起来几乎无懈可击. 但真正的问题在另一头: 一个只会看任务分数的优化器, 知不知道 skill 该长成什么形状? 它怎么判断"变得更长"是进步还

相关标签与本标签共现最多