AI 快讯
LIVE · 24h全网 AI 动态的中文速报,聚合引擎每 15 分钟更新。
- 9 月 1 日 18:0017:54
arXiv 论文探索写作中的主动思维伙伴设计
↗ 查看原文 · arxiv.org论文研究了写作中主动提供高层次认知支持的 AI 代理设计空间,通过技术探针部署一周发现,用户重视可配置角色和主动性,以及…
- 9 月 1 日 17:0017:00
- 16:05
- 9 月 1 日 15:0014:43
VerTox 框架揭示神经排序模型易受语料投毒攻击
↗ 查看原文 · arxiv.org研究提出 VerTox,首个将语料投毒建模为可验证奖励引导强化学习问题的框架,能生成流畅且难检测的对抗文档,攻击成功率接…
- 14:42
Transformer 论文回顾:从翻译到 ChatGPT 的演进
↗ 查看原文 · dev.toGoogle 研究人员在改进机器翻译时,突破瓶颈催生了 Transformer 架构,进而推动了 GPT、BERT 等模…
- 9 月 1 日 14:0013:35
- 9 月 1 日 12:0011:47
- 11:35
- 9 月 1 日 09:0008:01
- 9 月 1 日 08:0007:56
- 07:56
- 07:44
- 07:27
- 9 月 1 日 05:0004:12
- 9 月 1 日 03:0002:04
WiseSpec框架:需求驱动提升代码生成准确率
↗ 查看原文 · arxiv.orgWiseSpec是一个面向仓库级代码生成的需求驱动智能体框架,通过自动构建结构化需求、执行评估并迭代优化,指导代码生成。…
- 9 月 1 日 02:0001:30
TrustPropRAG:基于反馈的文档信任传播提升RAG可靠性
↗ 查看原文 · arxiv.orgTrustPropRAG将文档关系构建为图,通过多跳传播和少量人工反馈估计文档信任度,用于改进检索和答案生成。评估显示其…
- 9 月 1 日 01:0000:27
ISO-RAG:几何感知框架降低多跳问答延迟
↗ 查看原文 · arxiv.orgISO-RAG将知识图谱投影到双曲空间,通过拓扑净化剪枝噪声边,限制检索子图,提升多跳问答的检索召回率和精确匹配,同时消…
- 9 月 1 日 00:0023:27
EGT-KG:证据接地知识图谱提升小型语言模型科学问答
↗ 查看原文 · arxiv.orgEGT-KG是一个检索框架,通过证据接地的类型化知识图谱,增强小型语言模型在科学问答中的信息检索。在特定文献基准上,其最…
- 23:21
- 23:16
研究:新模型单提示词可超越多数LLM技术方案
↗ 查看原文 · arxiv.org一项研究分析了ICSE 2026的35篇LLM技术论文,发现37%至63%的复杂工具可被新模型上的单提示词原生超越,尤其…
- 8 月 31 日 21:0020:55
反馈驱动LLM代码修复的复制与Java扩展研究
↗ 查看原文 · arxiv.org研究部分复制了FeedbackEval基准,并扩展至Java,发现Python中的结论可能受基准构建、反馈表示和工具生态…
- 8 月 31 日 19:0018:42
- 8 月 31 日 18:0017:44
- 17:44
OntoAligner-Ensemble 融合异构本体对齐技术
↗ 查看原文 · arxiv.org新框架通过投票融合与后选择策略,整合词汇、知识图谱嵌入及大语言模型等多种对齐器。实验显示,集成方法能稳定改善精确率与召回…
- 17:30
- 8 月 31 日 17:0016:42
LoopArena:分析编码智能体外循环失败原因
↗ 查看原文 · dev.to阿里DreamX团队与新南威尔士大学发布论文LoopArena,研究编码智能体在外循环中失败的原因,论文已上传至arXi…
- 16:37
- 16:34
- 8 月 31 日 16:0015:15
- 15:07
Anthropic 新论文预示 AI 对齐方向转变
↗ 查看原文 · dev.toAnthropic 新论文实验显示 Claude 能自动化自身安全对齐,表现优于人类专家,暗示未来模型将更多参与自身安全…
- 8 月 31 日 14:0013:18
新基准AM-Bench揭示纯文本LLM的2D空间推理能力
↗ 查看原文 · arxiv.org研究引入AM-Bench基准,测试纯文本模型的空间推理。结果显示模型能可靠地将几何描述转为代码,但开放式布局能力差异大…
- 8 月 31 日 13:0012:26
研究揭示用户调用方式影响编码代理仓库投毒风险
↗ 查看原文 · arxiv.org新基准CIPR通过1920个实例测试发现,编码代理的漏洞高度依赖任务类型,测试执行任务成为静默攻击面,提示词表达也会间接…
- 8 月 31 日 12:0011:28
- 8 月 31 日 10:0009:29
- 09:04
- 8 月 31 日 06:0005:47
构建FAISS、BM25与smolagents的混合RAG系统
↗ 查看原文 · dev.to作者分享学习RAG过程中,结合FAISS、BM25和smolagents构建代理式混合RAG系统的经验,旨在提升检索与生…
- 8 月 30 日 21:0020:46
- 20:30
新方法DuoSteer提升代码生成安全性与正确性
↗ 查看原文 · arxiv.org研究提出CodeSec-Pairs数据集和DuoSteer双重引导方法,通过机制性解释定位安全相关组件,在多个模型上将漏…
- 8 月 30 日 19:0018:36
SearchWiki框架将语料转为可导航知识维基
↗ 查看原文 · arxiv.orgSearchWiki将语料库综合为分层维基,并训练WikiResearcher-9B智能体通过多轮工具使用检索信息。在多…
- 18:28
- 18:08
- 8 月 30 日 15:0014:29
- 8 月 30 日 13:0012:33
PAGE-RAG方法提升多跳问答检索准确性
↗ 查看原文 · arxiv.orgPAGE-RAG通过构建查询局部图并利用来源追踪等信号筛选候选,解决了检索中的连接-支持差距。在多个基准上,该方法显著提…
- 12:20
- 8 月 30 日 11:0010:50
- 8 月 30 日 08:0007:31
AgenticRag-R1 框架发布,强化学习结合栈记忆提升多步推理
↗ 查看原文 · arxiv.orgAgenticRag-R1 提出一种强化学习框架,通过栈记忆和细粒度动作空间整合推理、检索与记忆,并采用分层奖励和轨迹拒…
- 8 月 30 日 07:0006:36
论文提出智能体技能系统基础架构,涵盖九阶段生命周期
↗ 查看原文 · arxiv.org该论文为智能体技能建立统一系统基础,将其形式化为外部化程序知识,并详细阐述从自主发现到安全治理的九阶段生命周期,同时探讨…
- 8 月 28 日 20:0019:09
exit 0