你的请求在到模型之前,先绕了大半个地球
· 阅读约 2 分钟
拉各斯的朋友跟我抱怨,调 API 时不时慢得离谱,问是不是模型升级了。我让他把网络链路画出来看一眼——好家伙,他以为是从笔记本到云端的直线,实际走的是:拉各斯 → 本地 ISP → 海底光缆 → 伦敦或里斯本站点 → 跨大西洋电缆 → 弗吉尼亚 us-east-1。物理距离五千公里起步,光在光纤里还得打七折,光这一程的理论往返下限就 50 毫秒,加上路由跳数和排队,100 到 150 毫秒正常。
先别把这当性能问题。当攻击面问题看。
换成攻击者的思路:你每次调用都是一条物理上可预测的路——从拉各斯到弗吉尼亚,没有第二条。管道里走的是 prompt、密钥、业务数据。攻击者不需要黑进你的代码,只需要在这条路上找一个能嗅探的位置。尼日利亚有 17 个数据中心,14 个挤在拉各斯,但能跑前沿模型推理的 GPU 集群不在那。你的请求得去弗吉尼亚、爱尔兰、法兰克福。数据必须物理上出国一趟,经过你无法控制的路由节点、审计不了的电缆登陆站——甚至有没有流量镜像点,你都不知道。非洲数据中心容量占全球不到 1%,而这片大陆上几乎所有可用容量掌握在 Equinix、AWS、微软手里。这不是地缘阴谋论,是地理。
你品一下这个组合:延迟不可预测 + 请求绕了大半个地球 + 处理你数据的机房不在你管得着的司法管辖区。攻击者不用研究你的代码,他只需要在地球另一端的某段光缆上等着你的密钥路过。
有人会跳出来说,那用本地部署的开源模型不就行了。本地化砍掉一半攻击面,但砍不掉另一半:模型权重从哪下载、推理框架里有没有夹带。安全边界是整条链路,不是单一环节。
说能落地的。密钥轮换,立刻。你的 key 只要进过一次跨洋请求,或者在哪段日志、哪个你管不到的节点上路过,就当它已经泄漏,删聊天记录只是心理安慰。权限最小化不是老生常谈,是你在这条光缆上唯一能收回来的控制点。能把请求留在离自己近的地方,就留在近的地方——在拉各斯这不是技术选项,是地理现实。
排雷记录:150 毫秒别只当延迟看。那是你的数据离开你、绕了大半个地球、再回来的往返时间。攻击者不需要黑进你,他只需要在路上找个站。
评论
还没有评论,写下第一条讨论。