跳到主要内容

AI 快讯

LIVE · 24h

全网 AI 动态的中文速报,聚合引擎每 15 分钟更新。

  1. 9 月 9 日 09:00
    08:20

    开发者用原生JS构建59款免费浏览器工具

    开发者构建了Antigravity Tools,包含59款基于浏览器的免费开发工具,全部使用原生JS编写,并分享了过程中…

    ↗ 查看原文 · dev.to
  2. 08:16

    CGMIA:用成员推断攻击检测代码生成基准数据泄漏

    研究者提出 CGMIA,通过影子模型构建成员与非成员样本,结合 CodeBLEU、编辑距离、测试通过率、困惑度及 Cod…

    ↗ 查看原文 · arxiv.org
  3. 08:08

    学校市场平台弃用框架转向原生JS与PWA

    一个高流量学校市场平台为追求速度,放弃React等框架,改用原生JS和PWA技术构建,并分享了技术选型原因。

    ↗ 查看原文 · dev.to
  4. 9 月 9 日 08:00
    07:58

    NetArtifactBench:测试 AI Agent 能否修复网络实验记录漂移

    该基准包含 52 个注入不一致的实例,考察 Agent 在修复记录矛盾的同时保留有证据支持的结论。

    ↗ 查看原文 · arxiv.org
  5. 07:53

    MTP 技术解析:Qwen 与 Gemma 的多 token 预测

    文章解释多 token 预测技术,该技术让语言模型能一次预测多个未来 token,并提及 Qwen 和 Gemma 中的…

    ↗ 查看原文 · dev.to
  6. 07:37

    金丝雀部署未遇流量致故障未被发现

    团队曾为金丝雀部署自豪,但该部署未遇到本会使其失败的流量,导致潜在问题未被发现。

    ↗ 查看原文 · dev.to
  7. 07:35

    Claude Code权限规则与钩子优先级详解

    文章深入解析Claude Code的权限系统,澄清allow、deny和ask规则与钩子之间的优先级顺序,填补了文档空白…

    ↗ 查看原文 · dev.to
  8. 07:04

    LLM 建议 Postgres 索引,工具实测四成无效

    开发者构建工具,让模型为查询建议索引,并在事务中创建、重测、检查执行计划后回滚。结果显示四成建议未被采用。

    ↗ 查看原文 · dev.to
  9. 9 月 9 日 07:00
    06:57

    Claude Code 夜间运行公司,13 个免费防护确保安全

    Claude Code 被用于夜间管理公司,一个命令安装 13 个预执行防护,阻止推送主分支、无 WHERE 的 DEL…

    ↗ 查看原文 · dev.to
  10. 06:50

    CS-Guard:首个代码生成安全护栏基准发布

    该基准包含 1000 条恶意代码生成提示、7 种越狱攻击、虚构场景攻击及 331 条代码到代码提示,评测 7 个模型上的…

    ↗ 查看原文 · arxiv.org
  11. 06:50

    开发者用 2006 年旧电脑进行 16 个哈希实验

    一位开发者没有实验室或真实数据,仅用 2006 年的 Toshiba 笔记本进行 16 个哈希实验,回应了“无用”的质疑…

    ↗ 查看原文 · dev.to
  12. 06:41

    Pairit:支持人机协作实时实验的在线平台

    研究者推出 Pairit,用户通过单个 YAML 配置文件声明实验图,包括页面、随机化、匹配、聊天、共享工作区、服务端…

    ↗ 查看原文 · arxiv.org
  13. 06:38

    开发者实测多款 AI 编码助手后谈付费选择

    有编辑团队用一个月时间测试了能找到的多款 AI 编码助手,并分享最终实际付费使用的工具,属于其 AI 工具测试系列第四篇…

    ↗ 查看原文 · dev.to
  14. 06:37

    QTGNN v2:用4量子比特电路替换图神经网络消息函数

    开发者分享了QTGNN v2的构建日志,将图注意力网络中的消息函数替换为4量子比特量子电路,探索量子计算在图神经网络中的…

    ↗ 查看原文 · dev.to
  15. 06:23

    开发者开源 AI Agent 技能集合 SKILL.md

    开发者创建免费开源 GitHub 仓库,提供可直接放入的 SKILL.md 文件,为 AI 编程 Agent 扩展技能。

    ↗ 查看原文 · dev.to
  16. 06:16

    XAgent:执行引导的智能体框架提升 GitHub 问题修复率

    论文提出 XAgent,通过分析程序动态行为与额外上下文来定位和验证 GitHub 问题,在 SWE-bench-lit…

    ↗ 查看原文 · arxiv.org
  17. 06:12

    微调结合 KV 缓存重算,长上下文 RAG 精度与首字延迟双改善

    研究提出在微调时考虑 KV 缓存拼接,并有选择地重算部分缓存。在 RULER 基准 124k token 输入下,得分比…

    ↗ 查看原文 · arxiv.org
  18. 06:05

    审查AI生成UI的关键检查点

    文章提出审查AI生成UI时需关注输入验证等细节,因为AI虽能快速构建表单或仪表盘,但可能忽略安全与功能完整性。

    ↗ 查看原文 · dev.to
  19. 06:01

    全栈样板项目发布,加速AI辅助编码开发

    开发者发布了一个即用型全栈样板项目,旨在提升开发速度和清晰度,并优化AI辅助编码体验。

    ↗ 查看原文 · dev.to
  20. 9 月 9 日 06:00
    05:33

    CauterRule v0.2.0 发布,强化 Agent 规则防护

    CauterRule 发布 v0.2.0 版本,现已在 GitHub 和 PyPI 上线。该工具旨在防止针对 Agent…

    ↗ 查看原文 · dev.to
  21. 05:32

    LangGraph 在107项数据工程任务基准测试中胜出

    一项针对 LangGraph、CrewAI 和 AutoGen 的基准测试显示,LangGraph 在107项真实数据工…

    ↗ 查看原文 · dev.to
  22. 05:20

    实践:基于追踪的CI/CD捕获并重放生产智能体故障

    文章介绍了一种追踪原生的CI/CD方法,用于捕获和重放生产环境中的智能体故障。该方法旨在提高智能体系统的可靠性和调试效率…

    ↗ 查看原文 · dev.to
  23. 05:02

    蚂蚁百灵发布金融增强模型Ling-3.0-flash-Fin

    蚂蚁集团百灵推出首个金融增强开放模型Ling-3.0-flash-Fin,标志着AI开始进入真实投研工作流。

    ↗ 查看原文 · qbitai.com
  24. 9 月 9 日 05:00
    05:00

    早期评估可将LLM令牌使用量减半

    一项研究发现,在仅处理提示词一小部分后预测LLM是否成功,可将令牌使用量减半。这为优化成本提供了新思路。

    ↗ 查看原文 · dev.to
  25. 04:59

    Quote.Vote v2 RC2 发布,进入并行协作阶段

    Quote.Vote 宣布 v2 RC2 发布,是其重建过程中的又一里程碑。项目方表示第七阶段已就绪,欢迎并行贡献者参与…

    ↗ 查看原文 · dev.to
  26. 04:59

    AI面临发现难题:能力隐藏于空白提示框后

    文章指出AI采用的最大瓶颈是用户不知道其能做什么,能力被空白文本框隐藏。模板和上下文只能部分解决,核心问题在于用户需先知…

    ↗ 查看原文 · mhacevedo.com
  27. 04:53

    数学家面临AI挑战:毕生工作数日被完成

    本周有数学家发现,自己毕生研究的问题被AI在数日内解决,引发对职业价值与未来的思考。

    ↗ 查看原文 · dev.to
  28. 04:52

    具身机器人超市盘点应用,全球七万门店测试中

    两家公司正将具身智能机器人用于超市盘点,从演示走向实际货架,全球七万家门店正在验证其效果。

    ↗ 查看原文 · qbitai.com
  29. 04:39

    输出中不包含生成它的设置信息

    文章指出,AI输出中不包含产生该输出的配置参数,这可能导致复现和调试困难。作者通过示例展示了这一问题的普遍性。

    ↗ 查看原文 · dev.to
  30. 04:34

    Claude 会话导出不再只是文本记录

    导出使用过 Artifacts 的 Claude 会话并查看结果,发现其结构已变化,不再仅仅是对话文本记录。

    ↗ 查看原文 · dev.to
  31. 04:34

    Dev.to 冷数据回填提速 10 倍

    Dev.to 将逐篇文章重算改为批量 SQL 聚合,使冷数据回填的中位时间缩短 90.1%。

    ↗ 查看原文 · dev.to
  32. 04:30

    用机器学习检测勒索软件:延迟是关键

    文章认为勒索软件检测是延迟问题而非精度问题,并探讨了基于Sysmon行为特征、模型选择及生产环境中的挑战。

    ↗ 查看原文 · dev.to
  33. 04:30

    微调模型表现更好或因评估有误

    一个早期微调模型看似优于基线,但结果在修正评估方法后消失,提示评估流程缺陷可能导致误判模型性能。

    ↗ 查看原文 · dev.to
  34. 9 月 9 日 04:00
    03:58

    Linux CPU占用100%排查指南发布

    一篇结构化终端排查指南发布,帮助用户识别Linux系统CPU占用过高是源于失控代码还是其他原因。

    ↗ 查看原文 · dev.to
  35. 03:49

    OpenWorkProof更新:核心1.4.0与DeepSeek集成

    OpenWorkProof发布核心1.4.0版本及首个DeepSeek相关更新,并介绍了当前可验证的功能。

    ↗ 查看原文 · dev.to
  36. 03:39

    SkyProduction联合通义万相推出Wan 3.0限免活动

    SkyProduction与阿里巴巴通义万相合作,在8月28日至9月1日期间限时免费提供Wan 3.0模型使用。

    ↗ 查看原文 · qbitai.com
  37. 03:37

    Agent 钩子默认故障模式为 Fail-open

    Handrail 作者指出,agent 钩子的默认故障模式是 fail-open,即失败时默认放行。这可能导致安全风险…

    ↗ 查看原文 · dev.to
  38. 03:26

    DailyVox 语音日记应用无网络权限

    开发者构建的语音日记应用 DailyVox 不申请网络权限,因此无法进行任何分析调用或数据回传,强调隐私保护。

    ↗ 查看原文 · dev.to
  39. 03:14

    RoboCup 机器人竞赛:展望未来

    RoboCup 机器人竞赛引发对机器人未来的思考,常设想人形机器人与人类同行。该赛事推动机器人技术发展。

    ↗ 查看原文 · dev.to
  40. 03:10

    零依赖迁移器:签名相等不等于行为相等

    文章指出go.mod文件只能列出依赖项,无法揭示其行为差异。作者构建了一个零依赖的迁移工具,以应对依赖替换时签名相同但行…

    ↗ 查看原文 · dev.to
  41. 03:02

    Qwen3.8-Flash-Next 模型入门指南发布

    面向初学者的指南介绍了Huggingface上的Qwen3.8-Flash-Next模型,帮助用户快速上手使用。

    ↗ 查看原文 · dev.to
  42. 9 月 9 日 03:00
    02:35

    LoRA适配器独立运行,保留验证集权衡

    一项实验探讨两个主题特定LoRA适配器能否独立工作,结果显示其保留验证集上的权衡可见。

    ↗ 查看原文 · dev.to
  43. 02:31

    开发者构建RWKV-7与KAN适配器,改写散文不改变事实

    一位开发者创建了结合RWKV-7和KAN的适配器,用于改写文本,使内容更自然而不改变原意。此工具旨在提升散文流畅度,同时…

    ↗ 查看原文 · dev.to
  44. 02:17

    Claude Code无人任务失败主因:git push占64%

    一项对72次无人值守Claude Code任务失败的统计显示,其中46次失败发生在git push环节,成为主要故障点。

    ↗ 查看原文 · dev.to
  45. 02:15

    宜宾举办机器人招聘会展示产业雄心

    9月3日,宜宾国际会展中心举行了一场特殊的机器人“招聘会”,55支团队参与,旨在推动当地机器人产业发展。

    ↗ 查看原文 · qbitai.com
  46. 02:14

    Python工具在无人关注的平台出现独特bug

    开发者分享了一个仅出现在特定平台上的bug,该工具拥有数千项回归测试,但问题仍未被发现。此事件凸显了跨平台测试的盲点。

    ↗ 查看原文 · dev.to
  47. 9 月 9 日 02:00
    01:33

    Phoenix V2 发布:AI 认知架构可记忆、情感与进化

    Phoenix V2 作为 AI 认知架构发布,包含论文、代码和书籍。该架构旨在解决 AI 模型更新后丢失先前构建内容的…

    ↗ 查看原文 · dev.to
  48. 01:32

    OpenAI与Anthropic研究员辞职,指责AI竞赛不负责任

    Jacob Coxon宣布从Anthropic辞职,此前在OpenAI和Anthropic从事预训练研究三年。他公开批评…

    ↗ 查看原文 · twitter.com
  49. 01:31

    演示AI代理可观测性与评估:Strands、Phoenix与AWS Bedrock

    文章介绍了在AWS上使用Strands、Phoenix和Bedrock进行AI代理的可观测性和评估,内容源自一次相关演讲…

    ↗ 查看原文 · dev.to
  50. 01:26

    测试全过却读不到真实数据:工具缺陷分析

    开发者报告其读取GitHub Issues的工具虽通过所有测试,但实际无法读取任何真实记录,暴露测试与真实环境脱节问题。

    ↗ 查看原文 · dev.to