54 次调用跑完,我记下来的不是排名,是三种不报错的失败
前几天翻到一份公开的推理端点对比测试:六个模型、三种提示形态、每个模型跑三次,一共 54 次调用。每次记了首 token 时间、总耗时和单次成本,总花费 0.0185 美元。发出去的地方是从欧洲的笔记本上,晚上十点左右,带着跨大西洋的网络条件。 点进去本来是想看谁快的。

前几天翻到一份公开的推理端点对比测试:六个模型、三种提示形态、每个模型跑三次,一共 54 次调用。每次记了首 token 时间、总耗时和单次成本,总花费 0.0185 美元。发出去的地方是从欧洲的笔记本上,晚上十点左右,带着跨大西洋的网络条件。 点进去本来是想看谁快的。
