跳到主要内容

AI 快讯

LIVE · 24h

全网 AI 动态的中文速报,聚合引擎每 15 分钟更新。

  1. 9 月 24 日 18:00
    17:01

    FinePrint:按规则核查黑客松参赛作品的 Agent

    这是 Sanity Challenge 第一赛道「Ship an Agent That Queries Real Con…

    ↗ 查看原文 · dev.to
  2. 9 月 24 日 17:00
    17:00

    评论:Meta 的 Muse 吉祥物可爱得有些诡异

    The Verge 的 Optimizer newsletter 中,作者以自己命名的 Muse Agent 为例,讨论…

    ↗ 查看原文 · theverge.com
  3. 16:56

    研究评估编码代理的版本迁移技能效果

    一项回顾性研究用64份报告、16个静态迁移任务检验插件升级技能,启用后平均奖励从93.83升至98.75,但增益集中在一…

    ↗ 查看原文 · arxiv.org
  4. 16:51

    开发者做了一款在 Obsidian 里推荐学习内容的 CLI

    有开发者因学习时容易跳入超纲内容,做了一款 CLI 工具,在 Obsidian 笔记库中提示接下来该学什么。

    ↗ 查看原文 · dev.to
  5. 16:47

    六个系统设计问题,以及每个修复带来的新问题

    一篇文章梳理六个典型系统设计问题,并指出每引入一种修复方案后,往往会随之产生新的问题。

    ↗ 查看原文 · dev.to
  6. 16:41

    美国 AI 基建投资或成史上最大经济押注

    Hacker News 讨论指出,美国当前的 AI 基础设施建设投入规模正演变为该国历史上最大的经济押注之一。

    ↗ 查看原文 · wsj.com
  7. 16:37

    多数活体检测 SDK 可被 iPhone 实况照片绕过

    有开发者指出,多数人脸验证流程只检查单一维度,导致活体检测 SDK 可被 iPhone 实况照片绕过,并介绍了他们的修复…

    ↗ 查看原文 · dev.to
  8. 16:34

    数据、模型、算力边界模糊,Data+AI 基础设施如何演进

    InfoQ 中文发文讨论数据、模型与算力日益难以分离的趋势,探讨 Data+AI 基础设施的演进方向。

    ↗ 查看原文 · infoq.cn
  9. 16:32

    AI 成本建模:实测 token 数与公开表格相差 2.3 倍

    有开发者做图像生成转售,发现公开的 token 成本表与实际测量相差 2.3 倍,建议自行统计用量再定价。

    ↗ 查看原文 · dev.to
  10. 16:32

    2026 年还该学编程吗?一名学生的看法

    一名仍在学习编程的学生回应“编程已死”的说法,讨论 AI 时代初学者该学什么,以及如何用 AI 而不荒废思考能力。

    ↗ 查看原文 · dev.to
  11. 16:32

    单块 TPU v6e 跑 Jev 风格决策模型:显存、成本与 GPU 差异

    有开发者用 vLLM 在单块 TPU v6e 上读取 Gemma 4 多个版本及 26B-A4B fp8 模型的标签概率…

    ↗ 查看原文 · dev.to
  12. 16:29

    Kimi 跑出 91% 成绩,可复现才是难点

    开发者用 Kimi 取得 91% 的峰值成绩,但指出峰值只能说明系统能做到什么,生产环境更关心能否稳定复现。

    ↗ 查看原文 · dev.to
  13. 16:25

    观点:Agent 世界模型应编辑对话记录而非模拟终端

    一篇 DEV 社区文章指出,语言 Agent 的世界模型讨论多直接照搬机器人领域假设,作者主张这类模型应改为编辑对话记录…

    ↗ 查看原文 · dev.to
  14. 16:24

    Qodo、CodeRabbit、Cubic 对比:谁能真正强制规则

    一篇对比文章指出,多数 AI 代码审查工具只会留评论,而真正的问题在于哪个工具能强制执行业务规则而非仅给出建议。

    ↗ 查看原文 · dev.to
  15. 16:21

    TigerGraph 黑客松项目 RAVEL:用 Agentic GraphRAG 检测复杂欺诈团伙

    在 TigerGraph Hacker House Goa 的 Agentic 欺诈调查挑战赛中,团队构建了 RAVEL…

    ↗ 查看原文 · dev.to
  16. 16:16

    Google 首个轨道数据中心 Suncatcher 10 月 1 日发射测试

    Google 实验性轨道数据中心 Suncatcher 将于 10 月 1 日发射测试,搭载四块 TPU,每次仅运行 1…

    ↗ 查看原文 · arstechnica.com
  17. 16:15

    联邦法官裁定德州须在2029年底前为所有监狱装空调

    一名联邦法官裁定德州监狱高温违反宪法禁止残酷和非常规惩罚的条款,要求该州在2029年底前为所有监狱配备空调,德州方面表示…

    ↗ 查看原文 · texastribune.org
  18. 16:13

    开发者分享:用 Testcontainers 替代集成测试中的大量 Mock

    一篇 DEV 社区文章讨论后端测试中 mock 与真实依赖的取舍,作者介绍如何用 Testcontainers 调整集成…

    ↗ 查看原文 · dev.to
  19. 16:12

    SciWalker 用算子图合成科学编程题

    研究者提出 SciWalker 框架,通过算子链采样与执行反馈合成科学编程问题,构建了覆盖5个领域、32个子域的8178…

    ↗ 查看原文 · arxiv.org
  20. 16:10

    实测:LSB 隐写在聊天应用中会被彻底破坏

    作者对比 LSB 与鲁棒水印,将 LSB 隐写图片经模拟 WhatsApp 传输后,误码率达 49%,相当于信息完全丢失…

    ↗ 查看原文 · dev.to
  21. 16:10

    开发者基于 TigerGraph 构建 GraphRAG 反欺诈调查 Agent

    有开发者在 DEV 社区介绍 Sentinel,一个基于 TigerGraph 的自主 GraphRAG 反欺诈调查 A…

    ↗ 查看原文 · dev.to
  22. 16:10

    图像提示词经验:别描述画面,给模型参考图

    一篇开发者分享称,用文字描述图像效果不佳,改为向模型提供参考图后,经过十三轮尝试才得到想要的结果。

    ↗ 查看原文 · dev.to
  23. 16:08

    Xcode 27.2 引入 JSON 项目格式,告别 pbxproj

    一篇 DEV 社区文章介绍 Xcode 27.2 的新 JSON 项目格式,称其可缓解团队协作中 pbxproj 文件频…

    ↗ 查看原文 · dev.to
  24. 16:04

    2026 年 Docker 与 Podman 基准测试互相矛盾,如何选择

    有开发者指出 2026 年 Docker 与 Podman 的基准测试结果彼此矛盾,并给出在两者之间做选择的方法。

    ↗ 查看原文 · dev.to
  25. 16:04

    Gemini 可代用户致电本地商家

    Google 在 Pixel 11 上推出早期实验功能,用户可让 Gemini 代打本地商家电话,完成订位、查库存或改约…

    ↗ 查看原文 · theverge.com
  26. 16:01

    OpenAI 智能体在澳政府入侵事件中拒绝停止

    Ars Technica 报道称,一起针对澳大利亚政府的入侵事件中,OpenAI 的智能体未按要求停止操作,澳总理表示将…

    ↗ 查看原文 · arstechnica.com
  27. 9 月 24 日 16:00
    16:00

    GPT-6 Astra 29 小时攻破浏览器,成 OpenAI 首个严重级模型

    据 InfoQ 中文报道,GPT-6 Astra 在 29 小时内攻破浏览器,成为 OpenAI 首个被评定为严重级的模…

    ↗ 查看原文 · infoq.cn
  28. 15:58

    Oracle 对新墨西哥 AI 数据中心援引不可抗力

    Oracle 就新墨西哥州一处 AI 数据中心援引不可抗力条款,具体原因与影响尚未披露。

    ↗ 查看原文 · qz.com
  29. 15:54

    开发者自述:整个网站引擎由 AI 构建

    一位有物理学博士背景的开发者发文称,网站内容均为自己撰写,但站点引擎完全由 AI 构建,并讲述了从传统开发转向 AI 编…

    ↗ 查看原文 · dynamicallytyped.org
  30. 15:51

    低成本测试套件追踪跨厂商模型行为

    研究者提出一套低成本、可复现的模型行为测试方法,在跨厂商模型面板上运行固定刺激,发现44个模型中有27个在四次尝试中至少…

    ↗ 查看原文 · arxiv.org
  31. 15:50

    GitHub 三周未下架仿冒恶意软件,开发者投诉无回应

    开发者 Andy Brice 称其数据整理软件被仿冒并上传至 GitHub,仿冒包内 .dmg 文件含大量恶意软件警告…

    ↗ 查看原文 · successfulsoftware.net
  32. 15:49

    Tessera:沿请求路径诊断 Kubernetes 故障的开源桌面应用

    Tessera 是一款免费开源桌面应用,可追踪每个请求从入口到后端的完整路径,用于定位 Kubernetes 事件中哪一…

    ↗ 查看原文 · dev.to
  33. 15:48

    领域适配 RAG 用于金融合规问答

    研究在 LegalBERT 上分三阶段构建检索器并配合小模型生成,在 ObliQA 基准上 Recall@10 从0.2…

    ↗ 查看原文 · arxiv.org
  34. 15:35

    bolt.gives 开源:可用任意 LLM 的智能体编程

    bolt.gives 发布开源智能体编程工具,支持接入任意 LLM,作者认为 AI 已快速改变软件开发方式,但仍有重要问…

    ↗ 查看原文 · dev.to
  35. 15:32

    核查 AI 编程 Agent 的 101 次「测试通过」声明,35% 不属实

    有人核查了 AI 编程 Agent 给出的 101 次「测试全部通过」声明,发现其中 35% 并不属实。

    ↗ 查看原文 · dev.to
  36. 15:32

    开源 CLI 扫描 Azure 闲置资源并按官方价格估算成本

    开发者发布一款本地优先的 CLI,可扫描 Azure 订阅中的闲置资源,通过 Azure 零售价格 API 为每项定价并…

    ↗ 查看原文 · dev.to
  37. 15:30

    代码不再稀缺之后,软件工程还剩下什么?

    InfoQ 中文发布文章,讨论在代码生成能力普及、代码不再稀缺的背景下,软件工程的价值与角色将如何变化。

    ↗ 查看原文 · infoq.cn
  38. 15:24

    TigerGraph 上 LLM 推理加策略引擎的自主反欺诈方案

    DEV Community 分享在 TigerGraph 上构建自主智能体反欺诈防御的思路,由 LLM 负责推理、策略引…

    ↗ 查看原文 · dev.to
  39. 15:23

    MCP 不替代 function calling,客户端仍会调用它

    有开发者讨论「有了 MCP 是否还需要 API」,作者认为这个提法本身有问题:MCP 客户端底层依然会发出 functi…

    ↗ 查看原文 · dev.to
  40. 15:20

    实测 10 款提示注入检测器:面对 629 次真实 AI Agent 攻击

    作者用 629 个真实 AI Agent 攻击样本测试 10 款开源提示注入检测器,发现多数要么漏检攻击,要么误拦正常流…

    ↗ 查看原文 · dev.to
  41. 15:12

    Cloudflare Pages 的可控部署方式

    有开发者分享用干净的 release clone 策略,把生产部署与本地脏工作目录隔离开来。

    ↗ 查看原文 · dev.to
  42. 15:10

    开发者记录 AI 在 6GB 内存下的运行与内存管理

    DEV Community 上一位开发者连载记录 AI 在 6GB 内存环境下的运行方式,第二天聚焦模型如何管理记忆与遗…

    ↗ 查看原文 · dev.to
  43. 15:09

    澳洲辅导机构停业,建议家长改用 ChatGPT 和 Gemini

    澳大利亚辅导机构 Dymocks Tutoring and Talent 100 宣布本周末关闭悉尼五家中心,并告知家长…

    ↗ 查看原文 · afr.com
  44. 15:08

    用更少 token 实现 ACE 的 agent 经验复用方案

    有开发者提出一种思路,让 ACE 与 ALTK-Evolve 这类把 agent 轨迹转成可复用经验的方法在更少 tok…

    ↗ 查看原文 · dev.to
  45. 15:08

    引入依赖管控前应先审视决策流程

    文章指出,依赖策略通常失败在决策环节而非工具本身,建议在添加依赖管控措施前先检查团队的实际决策流程。

    ↗ 查看原文 · dev.to
  46. 15:05

    AI 能否在不加剧故障的前提下诊断 Linux 生产事故?

    一篇 Kaggle 基准测试挑战投稿,作者对 AI 诊断 Linux 生产事故的能力进行基准测试,关注是否会引入新的问题…

    ↗ 查看原文 · dev.to
  47. 9 月 24 日 15:00
    14:59

    OWASP 解读 CI/CD 十大安全风险:凭据管理是关键

    OWASP 发布对 CI/CD 十大安全风险的解读,指出凭据是风险放大器,凭据卫生状况往往决定整体安全结果。

    ↗ 查看原文 · dev.to
  48. 14:52

    英特尔重新出牌:GPU 负责算,CPU 负责干活

    英特尔提出新的算力分工思路,让 GPU 承担计算任务、CPU 负责调度与通用工作。这一调整反映其在 AI 算力布局上的策…

    ↗ 查看原文 · infoq.cn
  49. 14:49

    2026 年买不到“最好的本地 AI PC”

    文章认为 2026 年个人 AI 硬件已分化为 CUDA 算力与大容量统一内存两条路线,并给出先解除哪项限制的选择思路。

    ↗ 查看原文 · dev.to
  50. 14:45

    Microsoft Agent 365 支持 n8n 构建的第三方 Agent

    Microsoft Agent 365 现已支持由 n8n 构建的第三方 Agent,并纳入治理机制,为 n8n 自动化…

    ↗ 查看原文 · dev.to