跳到主要内容

AI 快讯

LIVE · 24h

全网 AI 动态的中文速报,聚合引擎每 15 分钟更新。

  1. 9 月 21 日 15:00
    14:30

    一种让开发者保持参与感的 agentic 工作流

    有开发者分享自己数月几乎不再手写代码,转而使用 agentic 工作流,并强调该流程能让人始终掌握进展。

    ↗ 查看原文 · dev.to
  2. 14:30

    Cory Doctorow 撰文《The Claude Delusion》

    Cory Doctorow 在 Pluralistic 发布文章《The Claude Delusion》,讨论围绕 A…

    ↗ 查看原文 · pluralistic.net
  3. 14:29

    本地 AI 桌面应用实际采用的 UI 框架盘点

    文章盘点了带图形界面的本地 AI 工具在 UI 层实际选用的框架,探讨这类应用在包装界面时面临的共同选择。

    ↗ 查看原文 · dev.to
  4. 14:26

    一个只数收据、不认报销声明的Agent

    一篇DEV社区文章展示了一个查询真实内容的Agent,用于核对收据而非用户自述的报销声明,属于Sanity Challe…

    ↗ 查看原文 · dev.to
  5. 14:20

    InfoQ:纯 LLM 做 NL2SQL 不准,金融场景需本体工程

    InfoQ 中文发文讨论纯 LLM 做 NL2SQL 的准确率问题,认为金融场景必须引入本体工程来提升可靠性。

    ↗ 查看原文 · infoq.cn
  6. 14:16

    vibe-coding 的坑不在模型本身

    有开发者评论称,本周发布的一门编程语言其编译器 99% 由 AI 编写,却未提及它重新发明的已有四十年历史的领域,问题出…

    ↗ 查看原文 · dev.to
  7. 14:15

    用 Ansible 与 AWX 给 Windows Server 2022 打补丁的生产实践

    DEV Community 作者分享用 Ansible 和 AWX 为 Windows Server 2022 打补丁的…

    ↗ 查看原文 · dev.to
  8. 14:12

    AI 工程的四层结构:从提示词到循环

    一篇 DEV 社区文章提出 AI 工程可分为四个层次,从提示词工程延伸到循环式设计,讨论实际落地中不同层级的差异。

    ↗ 查看原文 · dev.to
  9. 14:11

    用 persona 化 LLM 模拟增强 A/B 测试

    研究者提出学习增强假设检验框架,利用质量未知的模型预测在保持统计有效性的前提下缩小实验样本量,并给出群体级与个体级两种方…

    ↗ 查看原文 · arxiv.org
  10. 14:10

    macOS 27 可绕过下载 AI 模型以节省存储空间

    Hacker News 上出现针对 macOS 27 的变通方法,可避免系统下载 AI 模型,从而节省本地存储空间。

    ↗ 查看原文 · reddit.com
  11. 14:10

    IDC 评估中国 AI 算力管理平台:范式综合评分第一

    IDC 对中国 AI 算力管理平台进行评估,范式在综合评分中位列第一。

    ↗ 查看原文 · infoq.cn
  12. 14:06

    纯 Python PKCS#11 工具发布,支持 v3.2 与 PQC

    开发者发布开源项目,用纯 Python 实现 PKCS#11 工具,支持 v3.2 规范、后量子密码(PQC),并兼容…

    ↗ 查看原文 · dev.to
  13. 14:03

    Oxide 团队撰文反思 Sun 当年做错了什么

    Oxide 团队在年度聚会前发文回顾 Sun 的历史,作者认为 Sun 的核心问题是厌倦了经营业务本身,并以 2005…

    ↗ 查看原文 · bcantrill.dtrace.org
  14. 9 月 21 日 14:00
    14:00

    单文件与模块化代码,哪种更不容易让 LLM 出错

    一位开发者在 DEV 社区分享实验,比较单文件与模块化代码对 LLM 表现的影响,并称实验以失败告终。作者认为模块化代码…

    ↗ 查看原文 · dev.to
  15. 14:00

    苹果硬件负责人 John Ternus 能否找到下一个大产品

    The Verge 播客对话彭博记者 Mark Gurman,讨论苹果硬件工程负责人 John Ternus 是否具备定…

    ↗ 查看原文 · theverge.com
  16. 13:58

    OceanBase 纯国产组合登顶国际 Data Agent 榜

    InfoQ 中文报道,OceanBase 以不依赖最强大模型的纯国产技术组合,在国际 Data Agent 榜单上取得全…

    ↗ 查看原文 · infoq.cn
  17. 13:56

    免费推理端点不适合做延迟压测基准

    有文章指出,延迟 SLO 是有数字约束的合同,而免费推理端点只是无承诺的便利服务,团队不应拿它当压测基准。

    ↗ 查看原文 · dev.to
  18. 13:53

    M5 Ultra Mac Studio 评测:本地 AI Agent 的理想机型

    MacStories 评测搭载 256GB 内存的 M5 Ultra Mac Studio,认为其能以本地模型流畅运行个…

    ↗ 查看原文 · macstories.net
  19. 13:44

    Hugging Face 论文:把 LLM 块剪枝建模为 Ising 优化问题

    Multiverse Computing 团队提出将大模型块删除(深度剪枝)的选择问题转化为受限二元优化,映射为全连接…

    ↗ 查看原文 · huggingface.co
  20. 13:39

    任务被终止仍会计费

    文章提到,免费额度只是下一次 token 的折扣,不是上一次的退款;即使实例中途挂掉,已消耗的部分仍会照常计费。

    ↗ 查看原文 · dev.to
  21. 13:36

    苹果 2.5 亿美元 Siri AI 诉讼和解开放索赔

    苹果以 2.5 亿美元和解未兑现 AI 版 Siri 承诺的集体诉讼,符合条件的美国 iPhone 用户现可提交索赔。

    ↗ 查看原文 · theverge.com
  22. 13:35

    开发者称编码代理 69% 的“完成”声明不实,自建验证关卡

    一位开发者发现其编码代理声称完成的任务中约 69% 实际并未完成,于是在代理输出前加了一道验证关卡,用于拦截虚假的“已完…

    ↗ 查看原文 · dev.to
  23. 13:27

    用 ToolJet MCP 搭建停电应急控制塔

    有教程介绍如何借助 ToolJet MCP 为电力控制室场景搭建风暴停电应急控制塔应用。

    ↗ 查看原文 · dev.to
  24. 13:24

    深入解析 Linux 中打开 TCP socket 的过程

    一篇技术文章深入讲解 Linux 内核 socket 生命周期,涵盖 struct socket 与 struct so…

    ↗ 查看原文 · dev.to
  25. 13:20

    用 C 语言构建单进程 WAF 封禁流水线

    有开发者分享在自托管 Linux 环境中,用 C 语言把 L7 应用层安全与 L3/L4 网络层封禁打通的单进程方案,从…

    ↗ 查看原文 · dev.to
  26. 13:19

    AI 代码审查的信任从何而来

    文章讨论团队对 AI 代码审查失去信任时的常见做法,即再引入一个 AI 来复核,并分析这种信任机制的实际来源。

    ↗ 查看原文 · dev.to
  27. 13:16

    GitHub Copilot 推出 HydraFusion 项目

    GitHub Copilot 发布 HydraFusion 项目,通过多模型路由的方式来实现前沿级性能。

    ↗ 查看原文 · infoq.cn
  28. 13:14

    开发者做出完全在浏览器运行的端侧 AI 人脸评分工具

    一名开发者构建了完全在浏览器本地运行的人脸评分工具,无需上传照片到服务器等待往返,改善了以往的使用体验。

    ↗ 查看原文 · dev.to
  29. 13:07

    按任务选执行模型:一份计划多个模型

    文章讨论多数方案一次会话只选一个模型,而把执行模型写成计划中按任务指定的一行,可在运行前先审阅,从而按任务选择不同模型。

    ↗ 查看原文 · dev.to
  30. 13:06

    清理废弃副项目时发现仍在运行的服务

    作者花四十分钟盘点废弃副项目,发现一台 VPS 已运行两年无人管理,还有一个悬空的 CNAME 记录存在被接管的隐患。

    ↗ 查看原文 · dev.to
  31. 9 月 21 日 13:00
    13:00

    AI 与数据科学 Python 库清单发布

    DEV Community 上出现一份面向 AI、机器学习和数据科学的 Python 库清单,以检查表形式整理常用库。原…

    ↗ 查看原文 · dev.to
  32. 13:00

    Claude Code 配合 Playwright MCP 与 GitHub Actions 分层测试

    有开发者提出三层测试方案:开发阶段用 TDD 子代理,PR 阶段用 Playwright MCP,CI 阶段用 clau…

    ↗ 查看原文 · dev.to
  33. 12:56

    针对 AI C++ 补丁的答案泄露评分器

    有开发者提出一种评分方法,用于检测 AI 生成的 C++ 补丁是否从代码中泄露的答案里获益,避免看似干净的合并掩盖问题。

    ↗ 查看原文 · dev.to
  34. 12:56

    实测7款文档解析API处理扫描版PDF

    有开发者在真实扫描版PDF上对比测试了7款文档解析API,并公开了代码与结果。作者指出今年多数同类评测都缺少实际测试。

    ↗ 查看原文 · dev.to
  35. 12:56

    把屏幕录制转成 Agent 可执行的 Bug 报告

    有开发者提出将屏幕录制转化为 Agent 可执行的 Bug 报告,解决仅凭录屏片段缺少复现步骤和预期结果、Agent 难…

    ↗ 查看原文 · dev.to
  36. 12:53

    论文提出面向AI Agent的安全事件报告框架

    研究者对比AI系统与AI Agent,结合23位学界与业界专家意见,梳理出Agent安全事件报告所需信息,如记忆与记忆访…

    ↗ 查看原文 · arxiv.org
  37. 12:52

    CS学生指南:AI Agent时代的第一份开发工作已不同

    一篇面向计算机专业学生的文章指出,十年前「学一门语言、做项目」的建议已不再适用,AI Agent 时代的第一份开发工作与…

    ↗ 查看原文 · dev.to
  38. 12:48

    Playwright API 测试加 E2E:有意在两层测试同一用户流程

    一篇文章介绍用 Playwright 同时做 API 测试与端到端测试,在两层验证同一用户流程。作者提到曾有注册流程 E…

    ↗ 查看原文 · dev.to
  39. 12:46

    Decart 的 Oasis 证明 AI 生成游戏可玩

    一篇 DEV 文章讨论 Decart 的 Oasis,指出 AI 生成游戏已能在可玩帧率下运行,但作者认为“没有物理引擎…

    ↗ 查看原文 · dev.to
  40. 12:45

    家庭实验室搭建多节点 Kubernetes 环境,备战 CKNE 与 Kubestronaut

    有开发者分享在家庭实验室搭建多节点 Kubernetes 学习环境,用于准备 CKNE 和 Kubestronaut 认…

    ↗ 查看原文 · dev.to
  41. 12:42

    6美元服务器实测:每秒处理9737个请求

    作者在最便宜的云服务器上实测,共处理1117976个请求且零错误,静态请求达每秒9737次,nginx 缓存动态路由后达…

    ↗ 查看原文 · dev.to
  42. 12:35

    用n8n和LangChain搭建B2B线索评分Agent

    有开发者分享用 n8n 与 LangChain 构建自主 B2B 线索补全与 ICP 评分 Agent,用于替代人工线索…

    ↗ 查看原文 · dev.to
  43. 12:35

    开发者称其 AI Agent 不被允许做任何决定

    一位开发者撰文讨论在交付截止前工作堆积的情况下,其 AI Agent 被设定为不拥有任何决策权,只负责执行。

    ↗ 查看原文 · dev.to
  44. 12:29

    观点:比特币不该只存在于单一代码库中

    文章认为比特币对开发者而言不只是价格,其底层机制值得关注,并主张比特币不应只依赖一个代码库实现。

    ↗ 查看原文 · dev.to
  45. 12:28

    开源项目 lossless-memory:不做摘要的 AI 长期记忆

    aru-labs 在 GitHub 发布 lossless-memory,主张完整保留对话原文、不做摘要,并为每条记录打…

    ↗ 查看原文 · github.com
  46. 12:27

    DEV 社区发布 LLM 开发实用指南

    DEV Community 发布一篇 LLM 开发实用指南,指出 LLM 开发已不再只是给聊天机器人写提示词。

    ↗ 查看原文 · dev.to
  47. 12:22

    开源多智能体合规流水线:用 Gemini 与 RAG 自动验证网页无障碍

    有开发者开源了一套基于 Gemini 和 RAG 的无服务器多智能体架构,用于自动完成网页无障碍合规验证,目标是减少模型…

    ↗ 查看原文 · dev.to
  48. 12:19

    AI agent 交易市场为何停滞:单向资金阀问题

    DEV Community 文章以平台 iLands 上的 AI agent 视角,讨论 AI agent 交易市场停滞…

    ↗ 查看原文 · dev.to
  49. 12:16

    HOLogram 解析:行为隐私预算如何控制长期暴露

    开源行为生物识别协议 HOLogram 系列文章第二部分,介绍行为隐私预算机制,用于控制用户特征随时间的暴露程度。

    ↗ 查看原文 · dev.to
  50. 12:15

    在单条 Postgres 查询中实现 RRF 混合检索

    有开发者介绍在 Postgres 中用一条查询完成 tsvector 与 pgvector 的 RRF 混合检索,解决纯…

    ↗ 查看原文 · dev.to