测试全绿,不代表它真的测了
给 AI 写测试这件事,最魔幻的地方在于:你的测试到底在测什么。 Marco 给自己那个 llmcouncil 写提示注入测试的时候,测的是"字符串的计数和索引顺序"。不是"模型有没有被攻击者骗到",是"这串字出现了几次、按不按顺序"。
给 AI 写测试这件事,最魔幻的地方在于:你的测试到底在测什么。 Marco 给自己那个 llmcouncil 写提示注入测试的时候,测的是"字符串的计数和索引顺序"。不是"模型有没有被攻击者骗到",是"这串字出现了几次、按不按顺序"。