跳到主要内容

AI 快讯

LIVE · 24h

全网 AI 动态的中文速报,聚合引擎每 15 分钟更新。

  1. 9 月 11 日 15:00
    14:41

    LLM 评审结果不稳定,如何做测试

    同一输入下,LLM-as-judge 评测两次可能一次通过一次失败,文章讨论在这种不确定性下如何开展测试。

    ↗ 查看原文 · dev.to
  2. 14:41

    工程师用 C 手写引擎,在 8GB 内存 CPU 上跑 2.78 万亿参数模型

    一名工程师为在家运行 Kimi K3,自行用 C 语言编写推理引擎,在仅 8GB 内存的 CPU 上运行 2.78 万亿…

    ↗ 查看原文 · dev.to
  3. 14:40

    Netflix 采用开源 Flink Autoscaler,支撑超 3 万个流式作业

    Netflix 采用开源的 Flink Autoscaler,用于支撑其超过 3 万个流式作业的弹性伸缩。

    ↗ 查看原文 · infoq.cn
  4. 14:32

    在同一个仓库并行运行4个Claude Code Agent的实践

    有开发者在DEV Community分享经验,介绍如何在同一仓库中同时运行最多四个Claude Code Agent而不…

    ↗ 查看原文 · dev.to
  5. 14:30

    开发者反思 AI 带来的速度悖论与隐形疲劳

    一篇开发者文章讨论 AI 辅助开发带来的速度悖论,认为无限生产力的错觉背后是难以察觉的疲劳。

    ↗ 查看原文 · dev.to
  6. 14:25

    Meta 因 AI 追问隐私问题调整建议提示

    Meta 表示将调整其 AI 聊天机器人给出的提示,此前一段视频显示该功能追问一名女性年幼女儿的个人信息。Meta 发言…

    ↗ 查看原文 · theverge.com
  7. 14:24

    同一模型换 4 种分词器,准确率差 30 个百分点

    一篇 DEV 文章对比同一模型、同一数据下 4 种分词方式,结果显示准确率差距达到 30 个百分点,说明分词方案对结果影…

    ↗ 查看原文 · dev.to
  8. 14:19

    语音路由失败应影响下一次调用

    文章讨论本地语音反射的路由规则:当工作站被占用时,一次失败的语音路径应当改变下一次调用的路由选择。

    ↗ 查看原文 · dev.to
  9. 14:17

    开发者因厌倦待办应用自建 To-Do App

    一位开发者在 DEV Community 发文,称自己对待办类应用关系复杂,最终因厌倦现有产品而自行构建了一个。

    ↗ 查看原文 · dev.to
  10. 14:07

    John Deere 自助维修服务遇冷,农民不买账

    WIRED 记者体验了 John Deere 面向机主的自助维修订阅服务,几分钟内自行修好传感器,但农民普遍不愿使用该服…

    ↗ 查看原文 · wired.com
  11. 14:05

    Anthropic 最高 320 万招销售,服务 Meta

    据报道,Anthropic 开出最高 320 万的薪酬招聘销售岗位,目的是服务 Meta 这一客户。

    ↗ 查看原文 · qbitai.com
  12. 14:05

    两次相同运行得分均为89,但有两个用例结果翻转

    作者此前发布的A/B测试出现异常:两次配置相同的运行得分都是89,却有两个用例的通过结果发生翻转,说明评测存在不稳定因素…

    ↗ 查看原文 · dev.to
  13. 9 月 11 日 14:00
    14:00

    复盘:ClinicLive 项目的真实成本与 AI 出错之处

    一位开发者发布 ClinicLive 项目复盘,回顾用 AI 构建真实应用的完整过程,并披露实际成本与 AI 在开发中出…

    ↗ 查看原文 · dev.to
  14. 13:59

    百度秒哒升级,打通开发交付接单

    百度秒哒再次升级,将开发、交付和接单环节全部打通,让最懂业务的人可以亲手搭建自己的系统。

    ↗ 查看原文 · qbitai.com
  15. 13:51

    Simon Willison 推荐 Python 猴子补丁库 wrapture

    Graham Dumpleton 于8月31日发布猴子补丁库 wrapture,可同时用于测试与可观测性追踪,作者几乎每…

    ↗ 查看原文 · simonwillison.net
  16. 13:40

    SOKKAN Inference 用四块 Intel Arc Pro B60 推出瑞士主权推理层

    SOKKAN Inference 本周新增名为 Swiss 的推理服务层,由部署在瑞士 Meyrin 的机器承载,使用四…

    ↗ 查看原文 · dev.to
  17. 13:37

    一次优化把语音指令要找的词删掉了

    有开发者上线语音指令功能,操作员发送的语音留言以某个关键词开头,但代码优化后该关键词被删除,导致识别失效。

    ↗ 查看原文 · dev.to
  18. 13:36

    Snowflake World Tour 观察:AI 有了工号,数据平台长出执行能力

    InfoQ 中文发布 Snowflake World Tour 现场观察,总结出三个变化,包括 AI 被赋予类似工号的身…

    ↗ 查看原文 · infoq.cn
  19. 13:33

    开发者称多数 AI 推理轨迹只是把答案倒着写出来

    DEV Community 一篇文章指出,多数 AI 展示的逐步推理过程可能只是把最终答案倒推着写出来,而非真正的推理链…

    ↗ 查看原文 · dev.to
  20. 13:27

    AI Agent 正在使用你的凭证

    文章指出许多 AI Agent 会直接使用用户的凭证,认为这首先是密钥管理问题,其次才是身份问题。

    ↗ 查看原文 · dev.to
  21. 13:25

    开发者教 git diff 读懂 JSON 和 YAML

    DEV Community 分享如何让 git diff 按 JSON 和 YAML 结构对比,避免格式化工具重排键名后…

    ↗ 查看原文 · dev.to
  22. 13:20

    MCP 与 A2A 的边界:不包装工具构建双 Agent 支持流程

    DEV Community 文章讨论 MCP 与 A2A 的职责分界,并演示如何在不做工具包装的前提下搭建两个 Agen…

    ↗ 查看原文 · dev.to
  23. 13:17

    AWS 与 SRE 实战手册第 8 篇:CloudWatch 架构与可观测性

    DEV Community 发布 AWS 与 SRE 实战手册系列第 8 篇,讲解 Amazon CloudWatch…

    ↗ 查看原文 · dev.to
  24. 13:17

    MCP 工具搜索让首次请求隐藏 40170 个 token

    在默认开启 MCP 工具搜索的情况下,Claude Code 新会话的首次请求隐藏了 40170 个 token,aut…

    ↗ 查看原文 · dev.to
  25. 13:05

    vlt 1.0 发布:可替代 npm,新增分阶段安装与恶意包防护

    包管理工具 vlt 发布 1.0 版本,宣称可无缝替代 npm,并新增分阶段安装、依赖图谱查询和恶意包防护功能。

    ↗ 查看原文 · infoq.cn
  26. 13:02

    把浏览器标签页当后端用

    一位开发者在手机上测试注册流程时,因所需 API 尚未存在,改用 json-server 等方案,把浏览器标签页当作临时…

    ↗ 查看原文 · dev.to
  27. 13:02

    Claude 用户绕过安全防护用于生物武器研究

    有 Claude 用户找到绕过安全防护的方法,将其用于生物武器相关研究。部分危险生物学研究与合法研究外观相似,给 AI…

    ↗ 查看原文 · arstechnica.com
  28. 9 月 11 日 13:00
    13:00

    刘震云对话马毅:AI 模仿不了人写不出的作品

    作家刘震云与学者马毅展开对话,讨论 AI 与创作的关系,认为人写不出来、想不到的作品,AI 也无法模仿。

    ↗ 查看原文 · infoq.cn
  29. 12:59

    AI Agent 与 Agentic AI 的架构区别

    文章指出 AI Agent 是构建的单个组件,Agentic AI 则是把多个组件连接起来的方式,混淆两者会浪费数月时间…

    ↗ 查看原文 · dev.to
  30. 12:53

    用 Docker Compose、Terraform 和 GitHub Actions 在 AWS EC2 部署 MER

    有开发者分享如何从零构建 MERN 全栈应用,并用 Docker Compose、Terraform 与 GitHub…

    ↗ 查看原文 · dev.to
  31. 12:41

    蚂蚁 CEO 韩歆毅:一句话就能下单,商业入口要变了

    蚂蚁 CEO 韩歆毅谈到,用户一句话即可完成下单,商业入口正在发生变化,未来竞争的不只是流量。

    ↗ 查看原文 · infoq.cn
  32. 12:30

    AMD 发布锐龙 AI Max PRO 400 系列,端侧智能体走向多模型协同

    AMD 发布锐龙 AI Max PRO 400 系列处理器,端侧智能体由此走向多模型协同。

    ↗ 查看原文 · infoq.cn
  33. 12:30

    把灾难恢复当作治理体系来看待

    文章认为灾难恢复的技术问题基本已解决,更难的是治理:由谁依据什么信息决定启用,以及决策会留下什么证据。

    ↗ 查看原文 · dev.to
  34. 12:25

    用 Terraform 搭博客:环境准备篇

    DEV Community 作者分享用 Terraform 搭建博客的系列文章开篇,讲述重新接触云服务时的环境准备与思路…

    ↗ 查看原文 · dev.to
  35. 12:22

    用 ToolJet MCP 搭建地理围栏合规登记系统

    教程演示如何借助 ToolJet MCP 构建地理围栏合规登记应用,面向大宗运输等需要位置合规的场景。

    ↗ 查看原文 · dev.to
  36. 12:17

    开发者用约 120KB 纯 C 与 SIMD 实现向量搜索库

    有开发者在 DEV 发布自研向量搜索库,约 120KB 纯 C 加 SIMD 实现,无外部依赖,主打面向 AI Agen…

    ↗ 查看原文 · dev.to
  37. 12:03

    如何调试一个允许出错的系统?

    一位开发者分享,自己写的运行时在同一篇草稿文章上生成了 70 个段落,由此引出对允许出错系统的调试思考。

    ↗ 查看原文 · dev.to
  38. 9 月 11 日 12:00
    12:00

    如何为AI招聘搭建有效的人类审核环节

    文章讨论AI招聘中human-in-the-loop的设计,认为不应只是招聘人员对模型排名点确认,而应建立对每项结果进行…

    ↗ 查看原文 · dev.to
  39. 11:59

    Windows 文件锁定工具多是摆设,作者自建真正不可读方案

    作者指出多数 Windows 文件锁定工具实际并未锁定文件,并介绍了自己实现让文件真正无法被读取的做法。

    ↗ 查看原文 · dev.to
  40. 11:58

    Kubernetes readiness 与 liveness 探针的语义与风险

    一篇 DevOps 文章讨论 Kubernetes 中 readiness 与 liveness 探针作为故障检测器的语…

    ↗ 查看原文 · dev.to
  41. 11:57

    研究:AI 生成的弱测试会让编码 Agent 表现更差

    Critic 研究发现,质量差的生成测试会降低修复成功率,并给出可运行的 Python 示例,用于识别会放行错误修复的测…

    ↗ 查看原文 · dev.to
  42. 11:57

    时间序列数据的隐藏复杂度与清洗指南

    一篇技术文章讨论时间序列数据中容易被忽视的复杂度,并给出数据清洗的实践建议。文章指出时间往往是数据集中最有价值的维度。

    ↗ 查看原文 · dev.to
  43. 11:45

    Audioproxy:为应用提供简单的音频变体方案

    有开发者介绍 Audioproxy,用于为应用生成音频变体。以播客托管或社交平台为例,用户上传 40 分钟音频后,可按需…

    ↗ 查看原文 · dev.to
  44. 11:44

    开发者让 AI 助手接入云平台并可直接开服务器

    有开发者通过 Krova Cloud 的 MCP 服务器,让 AI 客户端具备实际开通服务器的能力,并解释了自己为何不担…

    ↗ 查看原文 · dev.to
  45. 11:44

    开发者搭建 45 个 Agent 的创业点子评审面板

    有开发者分享了一套由 45 个 AI Agent 组成的评审系统,用于对创业点子做直接甚至尖锐的反馈,文章重点介绍了其架…

    ↗ 查看原文 · dev.to
  46. 11:44

    开发者用约 120KB 纯 C 与 SIMD 实现向量搜索库

    有开发者发布约 120KB 的纯 C 向量搜索实现,称冷启动快 3000 倍且零依赖,面向 AI Agent 场景。

    ↗ 查看原文 · dev.to
  47. 11:41

    模型之间互相认同,其实是在认同自己

    一篇技术文章指出,多个模型给出的答案高度一致,可能并非独立验证,而是模型在重复自身已有的偏好与输出。

    ↗ 查看原文 · dev.to
  48. 11:39

    一份暑期工作教给我的开发者经验

    开发者 ACatNight 在 DEV Community 发文,分享自己暑期打工经历对做开发的影响与体会。

    ↗ 查看原文 · dev.to
  49. 11:36

    Moonshot 被指实际调用 Claude 而非 Kimi

    有安全人士称,Moonshot 实际把请求转发给 Claude 而非自家 Kimi,并借此收集交互数据用于模型训练。相关…

    ↗ 查看原文 · twitter.com
  50. 11:24

    Instagram 负责人称关闭算法推荐后互动量下降一半

    Instagram 负责人 Adam Mosseri 在澳大利亚新闻发布会上表示,用户关闭推荐系统后互动量最多下降 50…

    ↗ 查看原文 · thenextweb.com