AI 快讯
LIVE · 24h全网 AI 动态的中文速报,聚合引擎每 15 分钟更新。
- 9 月 23 日 05:0004:25
1200亿tokens人类动作预训练,刷视频教机器人干活
↗ 查看原文 · qbitai.com研究用 1200 亿 tokens 的人类动作数据做预训练,让机器人通过观看视频学习操作,误差随规模按幂律下降。
- 9 月 23 日 03:0002:47
研究分析 GitHub Agentic Workflows 的编写与维护
↗ 查看原文 · arxiv.org研究分析了 276 个仓库的 1248 个 gh-aw Markdown 文件,发现这类工作流指令中位长度 556.5…
- 02:30
研究:VR 具身 AI 的共情感知主要来自语言回应
↗ 查看原文 · arxiv.org研究者开发了结合对话 AI 与实时表情、姿态模仿的 VR 咨询代理,20 人实验显示语言回应是感知共情最稳定的驱动因素…
- 9 月 23 日 02:0001:45
LatWeave:基于知识格的确定性多跳问答方法
↗ 查看原文 · arxiv.org该方法把知识组织为多维知识格,将多跳问答编译为 meet、compare、abstain 三个确定性算子,答案生成路径不…
- 9 月 22 日 22:0021:51
实测:4 个 Agent 成本 2.1 倍但成功率未提升
↗ 查看原文 · dev.to一项预注册的确定性任务测试显示,2 个与 4 个 Agent 各跑六次,4 个 Agent 成本为 2.115 倍,但任…
- 9 月 22 日 21:0020:59
- 9 月 22 日 20:0019:43
TileLang:以 Tile 思维编写 LLM GPU 内核
↗ 查看原文 · dev.toDEV Community 介绍 TileLang,主张用 Tile 的思维方式来编写 LLM 的 GPU 内核。
- 9 月 22 日 18:0017:59
Flash-dLLM:免训练加速扩散语言模型推理
↗ 查看原文 · arxiv.org研究提出免训练推理加速框架 Flash-dLLM,针对 KV 缓存与并行解码共同作用时的显存 I/O 瓶颈,设计融合缓存…
- 17:55
CliffCompaction:长程编程智能体的低成本上下文压缩
↗ 查看原文 · arxiv.org研究提出自动压缩技术 CliffCompaction,只截断或丢弃内容而不改写,避免上下文漂移,在有限上下文下最多降低…
- 17:13
随机对照实验:Figma Make 让产品设计提速约 20%
↗ 查看原文 · arxiv.org一项针对 50 名产品设计师和 50 名产品经理的随机对照实验显示,使用 Figma Make 的参与者完成任务时间约缩…
- 9 月 22 日 17:0016:48
- 16:18
- 16:10
- 9 月 22 日 16:0015:38
开发者让 Agent 反复优化,写出快于现有库的 Rust 代码
↗ 查看原文 · minimaxir.com有开发者通过让 Agent 持续优化代码,写出比现有最优库更快的 Rust 代码,在合适约束下速度提升约 2 到 20…
- 15:14
论文:AI Agent 治理借用心理学词汇导致系统性失效
↗ 查看原文 · arxiv.org一篇 arXiv 论文提出「学科语言迁移问题」,认为治理语境中描述 AI Agent 的学习、记忆、价值观等词汇来自心理…
- 9 月 22 日 15:0014:20
FeatLens:特征引导动态代码图提升仓库级代码生成
↗ 查看原文 · arxiv.orgarXiv 论文提出 FeatLens,用自然语言特征索引动态构建任务专属代码图,替代全仓库持久图和 LLM 探索。
- 14:12
AIDE^2 实现 AI 研究 Agent 的递归自我改进
↗ 查看原文 · arxiv.org论文提出 AIDE^2,让前沿 AI 研究 Agent 改写自身代码并在隐藏评测中筛选最优版本。8 天自主运行中累计发现…
- 9 月 22 日 14:0013:08
- 9 月 22 日 13:0013:00
SlopShape:仅凭结构特征识别 AI 生成网页内容
↗ 查看原文 · arxiv.org研究者提出 SlopShape,用 214 项结构特征区分人类与 AI 生成的商业网页内容,在未见过公司上宏 F1 达…
- 13:00
技术文章:embedding 本质是查找表,关键在于如何填充
↗ 查看原文 · dev.to一篇 ML 系列文章的第二部分提出,embedding 可理解为一张查找表,模型其余部分决定这张表如何被填充。
- 9 月 22 日 10:0009:37
- 09:18
研究:9至18岁用户弃用Google转向AI
↗ 查看原文 · norwegianscitechnews.com挪威研究人员分析173项国际研究后发现,AI本身既不增强也不削弱学生的批判性思维,且学界对学龄儿童使用AI的影响了解仍很…
- 09:16
DepFixRouter:依赖更新该不该叫修复 Agent 的轻量路由
↗ 查看原文 · arxiv.org研究者提出轻量路由器 DepFixRouter,用 PR 标题和机器人标记等创建时信号,判断哪些依赖更新 PR 需要升级…
- 9 月 22 日 08:0007:39
细粒度 MoE 专家选择冗余度高于预期,保留三分之二即可
↗ 查看原文 · arxiv.org一项覆盖 12 个细粒度 MoE 检查点、11 个基准的实证研究发现,每 token 的专家选择冗余度远高于现有做法:均…
- 07:34
Glasshouse v0.1 发布:面向 AI 系统的记忆基准
↗ 查看原文 · dev.toGlasshouse v0.1 发布,这是一个面向 AI 系统的长期记忆基准测试,作者称其基于此前两项相关工作。
- 07:22
研究:AI 代理合并的 PR 后续被修复概率更高
↗ 查看原文 · arxiv.org研究追踪五个 AI 编码代理的 6774 个已合并 PR,发现其被验证修复的几率是同期人类 PR 的 1.62 倍,其中…
- 07:20
MUDAPIBench:让代码大模型遗忘已废弃 API 的基准
↗ 查看原文 · arxiv.org研究者构建 MUDAPIBench,包含 8 个 Python 库、145 组废弃到最新 API 映射的 7000 多个…
- 9 月 22 日 07:0006:29
- 06:08
- 9 月 22 日 06:0005:51
深入 Postgres 索引:B-Tree、页分裂与查询计划器
↗ 查看原文 · dev.to一篇技术文章解析 Postgres 索引底层机制,涵盖 8KB 索引页、B-link 并发、页分裂的 WAL 放大,以及…
- 05:23
- 9 月 22 日 05:0004:29
合成消费者做视觉营销预测试:六项实验均未复现人类效应
↗ 查看原文 · arxiv.org研究用六项经典视觉营销实验测试生成式 AI 合成消费者,发现所有配置虽通过操纵检验,但最多只复现两项人类效应,且有一项出…
- 9 月 22 日 04:0003:25
ChatT2:面向天然产物研究的LLM多智能体框架
↗ 查看原文 · arxiv.org研究者提出ChatT2,一个针对细菌II型聚酮类天然产物的LLM智能体,采用导师、执行者、评估者三角色多智能体框架,结合…
- 9 月 22 日 03:0002:35
KEX-bench:评测编码智能体生成内核漏洞利用能力
↗ 查看原文 · arxiv.org研究者发布KEX-bench,覆盖40个Linux与Windows CVE的45个任务,测试编码智能体生成内核利用原语的…
- 9 月 22 日 01:0000:57
- 00:32
Pew 研究:在线自愿样本中的虚假受访者难以清除
↗ 查看原文 · pewresearch.orgPew 研究中心测试了陷阱题、CloudResearch 的 Sentry 预筛和选民档案匹配三种方法,发现选民档案匹配…
- 9 月 21 日 23:0022:53
RAG-NAROK:针对RAG检索感知的知识库投毒攻击
↗ 查看原文 · arxiv.org研究者提出RAG-NAROK,一种能根据查询文本自适应生成反驳文档的RAG投毒框架,通过点名并贬低被检索来源来引导生成结…
- 9 月 21 日 22:0021:54
ZeroGate:为受管控AI智能体运行时设计可信快速路径
↗ 查看原文 · arxiv.org研究者提出ZeroGate,将精确动作审批与本地准入分离,由签发方签署短期ActionPass,本地网关校验绑定并消耗n…
- 21:54
WeightBridge:强化学习权重传输库
↗ 查看原文 · arxiv.org研究者发布WeightBridge,自动解析训练端与推理端的权重布局对应关系,规划并执行无冗余、负载均衡的权重传输。测试…
- 21:19
- 9 月 21 日 21:0021:00
图神经网络与 Transformer 正在改变天气与气候建模
↗ 查看原文 · dev.to一篇技术文章梳理了图神经网络、Transformer、概率 AI 以及物理与机器学习混合系统在天气和气候建模中的应用,指…
- 20:56
- 20:38
- 9 月 21 日 20:0019:43
可视化 Transformer 讲解工具登上 Hacker News
↗ 查看原文 · poloclub.github.ioTransformer Explainer 用可视化方式讲解 Transformer 架构,基于 1.24 亿参数的 G…
- 9 月 21 日 19:0018:53
课程知识库用 LLM 编译 wiki 优于向量 RAG
↗ 查看原文 · arxiv.org研究对比同一机器学习课程语料上的两种知识表示:向量 RAG 与 LLM 编译的 wiki。单点事实题两者接近,但跨单元关…
- 18:53
Tim Dettmers:前沿 AI 可在自有硬件上运行
↗ 查看原文 · timdettmers.comTim Dettmers 在 dlab 开源周发文称,前沿 AI 研究不必依赖最多 GPU,学术实验室因资源有限反而可能…
- 9 月 21 日 18:0017:54
Google 提出 RRSI:正则化智能体框架自改进
↗ 查看原文 · arxiv.orgGoogle Research 提出 RRSI,通过约束候选提案与筛选过程,缓解智能体框架递归自改进在分布外任务上的过拟…
- 17:38
间接 tipping:AI 智能体群体的社会攻击面
↗ 查看原文 · arxiv.org研究指出,仅用临界质量衡量智能体群体的安全风险会低估脆弱性。通过中间平衡态实现的间接 tipping 可降低所需对抗智能…
- 17:22
研究:个人 AI 智能体按推断财富差别推荐
↗ 查看原文 · arxiv.org一项 32.5 万次实验的研究发现,13 个智能体中有 8 个模型在请求相同时,会为更富有的用户选择更贵的选项,即使被明…
- 17:16
用 TypeScript 计算建筑围护结构热桥与并联路径 U 值
↗ 查看原文 · dev.to一篇技术文章介绍如何用纯 TypeScript 实现 ASHRAE 90.1-2022 附录 A 的并联路径有效传热系数…