跳到主要内容

AI 快讯

LIVE · 24h

全网 AI 动态的中文速报,聚合引擎每 15 分钟更新。

  1. 9 月 15 日 19:00
    18:31

    AI Agent 在生产环境中的失败模式与恢复实践

    DEV 社区文章分析 AI Agent 在生产环境中的真实可靠性问题,并总结可观测性与恢复模式。

    ↗ 查看原文 · dev.to
  2. 18:30

    MCP 取消握手:如何构建无状态裸金属客户端

    文章指出自 2026-07-28 版 MCP 规范起,MCP 已取消握手环节,并讲解如何据此构建无状态的裸金属客户端,为…

    ↗ 查看原文 · dev.to
  3. 18:27

    支付宝开源 xUI:支撑“阿宝”的 Agentic 终端交互引擎

    支付宝公开 xUI,定位为“阿宝”背后的 Agentic 终端交互引擎,用于支撑智能体在终端场景下的交互。

    ↗ 查看原文 · infoq.cn
  4. 18:20

    论文提出 DRAG:按查询动态选择 RAG 检索器与生成器

    研究系统分析了检索器与生成器复杂度在事实型和多跳问答中的交互,发现更强检索收益更大但存在递减与非单调回报。

    ↗ 查看原文 · arxiv.org
  5. 18:11

    安全公司 25 分钟拿到 Baseten 生产 GitHub 管理员权限

    安全公司 Strix 在扫描 Baseten 时,25 分钟内获得其内部仓库的管理员权限,涉及一个 2023 年构建、2…

    ↗ 查看原文 · strix.ai
  6. 18:10

    大规模实证研究:157 个开源智能体项目质量保障存在缺口

    研究分析了 157 个 GitHub 星标过百的开源 LLM 智能体项目,考察其文档、代码、配置与测试。

    ↗ 查看原文 · arxiv.org
  7. 18:05

    功能开关墓地:安全网如何变成技术债

    文章讨论功能开关(feature flag)从最初的安全保障逐渐演变为技术债的过程,指出团队往往缺乏清理机制。

    ↗ 查看原文 · dev.to
  8. 18:01

    用 TypeScript 建模热泵平衡点与低温变频衰减

    一篇技术文章介绍如何用纯 TypeScript 建模寒冷气候下热泵的热平衡点、变频压缩机 COP 衰减以及辅助电加热带选…

    ↗ 查看原文 · dev.to
  9. 9 月 15 日 18:00
    18:00

    AI助手记性差是架构选择,不是能力问题

    有开发者指出,多数AI助手能力很强却极易遗忘上下文,这并非模型缺陷,而是架构层面的取舍。

    ↗ 查看原文 · dev.to
  10. 17:57

    论文提出 agentic society 需要「社会 harness」

    arXiv 论文指出,在跨信任边界的多智能体协作中,即使诚实且能力足够的智能体也常因现有通信机制而失败,恶意智能体还可利…

    ↗ 查看原文 · arxiv.org
  11. 17:47

    一文对比 MVC、MVP、MVVM、MVVM-C 与 VIPER 五种架构模式

    开发者 Maneshwar 在 DEV Community 发文,将 MVC、MVP、MVVM、MVVM-C、VIPER…

    ↗ 查看原文 · dev.to
  12. 17:37

    HN 讨论:Navier-Stokes 之后仍看空 LLM

    Hacker News 上出现一篇长文,作者称即便模型在 Navier-Stokes 等任务上有所表现,他仍对 LLM…

    ↗ 查看原文 · dank.systems
  13. 17:31

    Amazon EKS 渐进式部署实践:ArgoCD 与 Argo Rollouts 隔离分片

    一篇 DEV Community 文章介绍在 Amazon EKS 上用 ArgoCD 和 Argo Rollouts…

    ↗ 查看原文 · dev.to
  14. 17:28

    开发者打造终端工具,让一个 AI CLI 监督其他 AI CLI

    有开发者构建了一个终端,用一个 AI CLI 监督 Claude Code、Codex、Qwen 等其他 AI CLI…

    ↗ 查看原文 · dev.to
  15. 17:25

    GitHub 项目 Army 发布,对标 jOOQ

    开发者发布开源项目 Army,作者称其定位与 jOOQ 类似,文章中的代码示例均取自该项目仓库。

    ↗ 查看原文 · dev.to
  16. 17:24

    QQ飞车分享Agentic研发转型中的Loop Engineering实践

    QQ飞车团队介绍了在Agentic研发转型过程中对Loop Engineering的探索,属于工程实践分享。

    ↗ 查看原文 · infoq.cn
  17. 17:20

    开发者把CLAUDE.md从4.8万token压到4400并验证影响

    一位开发者将仓库中约4.86万token的CLAUDE.md精简至4400token,并实测精简后是否影响使用效果。

    ↗ 查看原文 · dev.to
  18. 17:20

    开发者做 Electron 轻量替代品 Natyv,发现空闲时占用 90% CPU

    开发者正在构建不打包浏览器引擎的原生桌面运行时 Natyv,作为 Electron 的更轻量替代方案,但发现它在空闲状态…

    ↗ 查看原文 · dev.to
  19. 17:12

    Windows 上 agent CLI 每条命令前卡顿 15 秒,Procmon 追踪定位

    有开发者记录了 Windows 上 agent CLI 在每条命令执行前停顿约 15 秒的问题,并通过 Procmon…

    ↗ 查看原文 · dev.to
  20. 17:11

    医生撰文:为什么我不做全身MRI扫描

    一位医生发文解释自己为何不选择全身MRI扫描,讨论这类筛查在医学上的实际价值与局限。

    ↗ 查看原文 · washingtonpost.com
  21. 17:06

    别再把整个互联网塞进7B参数模型

    有开发者撰文讨论把维基百科、Common Crawl 和大量开源数学论文都塞进 70 亿参数模型的做法,认为这种思路存在…

    ↗ 查看原文 · dev.to
  22. 9 月 15 日 17:00
    17:00

    前端没死,但岗位名称正在变化

    有开发者针对「前端已死」的说法做了调研,认为前端并未消亡,但相关岗位的职责与名称正在发生变化。

    ↗ 查看原文 · dev.to
  23. 16:56

    用编码 Agent 做非编码任务的 26 种方式

    有开发者在社区分享,编码 Agent 不只用于写代码,还能处理多种非编码任务,并给出 26 种具体用法。

    ↗ 查看原文 · dev.to
  24. 16:53

    Fathom:面向卸载 KV 缓存的按查询读取深度稀疏解码

    针对百万 token 智能体会话中 KV 缓存索引扫描成为解码瓶颈的问题,Fathom 让每个查询自行决定读取每个 ke…

    ↗ 查看原文 · arxiv.org
  25. 16:52

    OpenAI 发布 GPT-6 Astra,面向编程与计算机应用

    OpenAI 发布 GPT-6 Astra,定位适用于编程和计算机应用场景。目前仅有标题信息,具体能力与开放方式尚未披露…

    ↗ 查看原文 · infoq.cn
  26. 16:51

    开发者实测发现 RAG 拒答阈值形同虚设

    一名 Java 后端工程师在受监管医疗项目中测量 RAG 系统,发现拒答阈值实际未生效。他建议对这类阈值做量化验证,而非…

    ↗ 查看原文 · dev.to
  27. 16:50

    开发者复盘股票预测项目:线性回归的得与失

    一位开发者分享用简单线性回归做股票预测的实践复盘,讲述哪些做法有效、哪些地方会重新调整。

    ↗ 查看原文 · dev.to
  28. 16:48

    观点:Vibe Coding 只是 IDE 的下一层,工程远不止于此

    有开发者认为围绕 vibe coding 的讨论常纠结于代码由谁写,但这只是 IDE 演进的一层,软件工程的范围要大得多…

    ↗ 查看原文 · dev.to
  29. 16:42

    京东上线“东东”购物助手,内嵌于京东APP

    京东在原有APP内上线名为“东东”的购物助手Agent,定位为更懂用户的购物助手。

    ↗ 查看原文 · infoq.cn
  30. 16:38

    文章称 AI Agent 正在破坏互联网

    一篇评论文章认为,AI Agent 已获得足够权限在网络上自主行动,正在给互联网带来实际困扰,并提到 OpenAI 的…

    ↗ 查看原文 · 404media.co
  31. 16:36

    Amazon Quick 上用 MCP、agent 和 WhatsApp 做自动预警预案

    作者结合 MCP、agent 与 WhatsApp,在 Amazon Quick 上搭建能自动发出预警的应急方案,背景是…

    ↗ 查看原文 · dev.to
  32. 16:30

    AI 爬虫抓不到 JavaScript 链接,网站需调整可见性

    一项 41 天实验显示,AI 爬虫发现网站的方式与 Googlebot 不同,可能漏掉 JavaScript 生成的链接…

    ↗ 查看原文 · dev.to
  33. 16:30

    团队用未调优数据突袭流水线:手写体识别失败但安全架构守住

    一次外部评测中,面对真实医生连笔手写体,识别环节崩溃,但团队的安全架构经受住了考验。

    ↗ 查看原文 · dev.to
  34. 16:29

    开发者基准测试九种本地VLM流水线处理手写临床表单

    有开发者对九种本地VLM流水线配置在手写临床表单上做了基准测试,并公开了失败的实验。

    ↗ 查看原文 · dev.to
  35. 16:29

    开发者推出更安全的在线 JWT 解码替代方案

    针对开发者常把 JWT 令牌粘贴到随机在线工具的问题,作者构建了一个更安全的替代工具,避免敏感令牌泄露给第三方网站。

    ↗ 查看原文 · dev.to
  36. 16:29

    OSDHACK'26 复盘:AI 时代的黑客松怎么变

    OSDC 团队回顾其旗舰活动 OSDHACK'26,讨论 AI 工具普及后黑客松在选题、协作与评审上的变化。

    ↗ 查看原文 · dev.to
  37. 16:29

    研究称 SWE-bench 榜单已无法区分头部编码智能体

    一项对 254 份 SWE-bench 提交的审计发现,Verified 分榜前两名各解决 500 题中的 396 题…

    ↗ 查看原文 · arxiv.org
  38. 16:28

    14岁开发者fork Chromium并分享其中的难点

    一名14岁开发者此前持续向Linux内核提交补丁,如今fork了Chromium项目,并撰文讲述这一过程中的困难。

    ↗ 查看原文 · dev.to
  39. 16:27

    FlashVector:跨层优化模型服务栈的智能体系统

    论文提出 FlashVector,把单 GPU 内核优化智能体扩展到框架计算图、模型服务器和特征处理等异构层。

    ↗ 查看原文 · arxiv.org
  40. 16:18

    开发者让两个AI在Godot中竞速开发《Among Us》并中途换模型

    一名开发者让两个AI在Godot中竞速构建完整版《Among Us》,并在运行中途更换了模型,以检验开源权重模型的能力。

    ↗ 查看原文 · dev.to
  41. 16:09

    OpenAI 仅用 2 名工程师将核心存储从 Python 重写为 Rust

    OpenAI 被指有意保留技术债,等待 Codex 来偿还,最终由两名工程师把核心存储从 Python 重写为 Rust…

    ↗ 查看原文 · infoq.cn
  42. 16:07

    月之暗面否认创始人及员工信息传闻,称系恶意造谣

    月之暗面回应网传创始人及员工信息,称相关内容系恶意造谣。同期还有 OpenAI 放弃今年上市、iPhone Duo 被炒…

    ↗ 查看原文 · infoq.cn
  43. 16:01

    Claude 在英伟达内部被限用,黄仁勋称不会让 AI 发展放缓

    Claude 在英伟达内部被限制使用,黄仁勋向特朗普表示不会让 AI 发展放缓发生。

    ↗ 查看原文 · infoq.cn
  44. 9 月 15 日 16:00
    16:00

    IBM 研究:Agent 单次成功不代表可重复,一致性存在明显缺口

    IBM 研究指出,多数基准用平均值掩盖了 Agent 的波动性。

    ↗ 查看原文 · huggingface.co
  45. 16:00

    Google AI 发布 AI 社会影响案例合集

    Google AI 整理了一份案例合集,展示专家与地方领导者如何利用 AI 技术突破,让更多人分享 AI 带来的机会。

    ↗ 查看原文 · blog.google
  46. 16:00

    Google 称正构建理解多语言真实表达的模型

    Google 表示正从传统文本翻译转向构建能理解世界各地语言真实表达方式的模型。官方未披露具体模型名称与发布时间。

    ↗ 查看原文 · blog.google
  47. 16:00

    Google 发文谈用 AI 加速科学并改善生活

    Google 发文表示 AI 的真正衡量标准在于它帮助了谁,并聚焦先进技术能带来显著进展的关键领域。

    ↗ 查看原文 · blog.google
  48. 15:38

    SnapEnv Operator:让Kubernetes Secrets自动同步

    这是系列文章第三篇,介绍SnapEnv Operator如何实现Kubernetes Secrets自动同步与自动重载…

    ↗ 查看原文 · dev.to
  49. 15:26

    Formas 推出 AI 3D 建模工具 Cartesian

    Formas 发布 AI 3D 建模工具 Cartesian,面向建筑与产品设计,可通过文字、草图或照片生成可编辑的精确…

    ↗ 查看原文 · formas.ai
  50. 15:25

    测试全绿但架构变差:为编码智能体加确定性门禁

    开发者发现编码智能体虽能保持测试通过,代码架构却持续恶化,于是在 DATAMIMIC EE 核心项目中尝试引入确定性门禁…

    ↗ 查看原文 · dev.to