COSP 踩坑笔记:一致性筛选加 majority vote,是把模型的自信放大两遍
今天在读一篇讲 COSP 的文章,顺手记一下。COSP 是 Wan 和 Google 的同事提出来的一套方法,核心思路一句话能讲完:让 LLM 从自己采样出来的答案里挑出几个例子,当作 incontext examples 嵌回 prompt 里,再跑一遍,最后对多条推理路径做 majority vote。

今天在读一篇讲 COSP 的文章,顺手记一下。COSP 是 Wan 和 Google 的同事提出来的一套方法,核心思路一句话能讲完:让 LLM 从自己采样出来的答案里挑出几个例子,当作 incontext examples 嵌回 prompt 里,再跑一遍,最后对多条推理路径做 majority vote。
