AI 快讯
LIVE · 24h全网 AI 动态的中文速报,聚合引擎每 15 分钟更新。
- 9 月 26 日 10:0009:41
Haskell 社区讨论:在 LLM 时代如何保持编程乐趣
↗ 查看原文 · discourse.haskell.orgHaskell 社区论坛出现一篇讨论帖,作者谈到对 AI 倦怠、被低技能者取代的担忧以及项目代码质量下降,并提出在 LL…
- 09:07
FSD 级团队发布 Physical AI 首版模型 Simate-beta
↗ 查看原文 · qbitai.com该团队发布首版 Physical AI 模型 Simate-beta,训练、推理与评测全流程接入自研 Infra,可并行…
- 9 月 26 日 05:0005:00
- 04:42
- 9 月 26 日 03:0002:17
Claude Code 自动记忆单行事实可影响后续会话
↗ 查看原文 · dev.to测试显示,存入 Claude Code 自动记忆的一行事实在 4 次全新会话中有 3 次首次尝试即被应用,而两种方式都不…
- 9 月 25 日 23:0022:50
多奖励强化学习对比:PPO、GRPO、DAPO 与 GDPO
↗ 查看原文 · dev.to一篇技术文章对比了 GDPO 与 GRPO、DAPO、PPO 在多奖励 LLM Agent 后训练中的表现,涉及归一化数…
- 9 月 25 日 21:0020:59
- 20:35
- 9 月 25 日 20:0019:36
- 9 月 25 日 19:0018:37
- 9 月 25 日 17:0016:24
- 16:14
- 9 月 25 日 16:0015:33
- 15:29
RL 4:早期启发式与时间差分学习的诞生(1959–1968)
↗ 查看原文 · dev.to一篇回顾强化学习早期历史的文章梳理了1959至1968年间从贝尔曼方程到时间差分学习雏形的演进,指出当时计算机算力不足…
- 9 月 25 日 14:0013:24
Skild AI 用自我对弈训练人形机器人 Messinator 踢足球
↗ 查看原文 · qbitai.comSkild AI 在 NVIDIA Isaac Sim 虚拟足球场中让机器人自我对弈约 140 年,仅以进球为奖励,最终…
- 9 月 25 日 13:0013:00
- 12:49
- 9 月 25 日 10:0009:18
- 09:03
- 9 月 25 日 08:0007:57
- 07:27
- 9 月 25 日 06:0005:53
- 05:30
DEV社区科普:Bagging如何提升机器学习模型稳健性
↗ 查看原文 · dev.toDEV社区发布文章介绍Bootstrap聚合与Bagging方法,讲解其如何通过组合多个训练数据排列下的模型结果,提升机…
- 9 月 25 日 05:0005:00
Grouped Value Attention将KV缓存削减约45%
↗ 查看原文 · dev.to有开发者提出Grouped Value Attention方法,可将Transformer的KV缓存内存削减约45%,且…
- 04:29
系列文章探讨多 AI Agent 协同为何最难驾驭
↗ 查看原文 · dev.toDEV Community 发布 AI Harness Engineering 系列第八篇随笔,讨论一群 AI Agen…
- 9 月 24 日 22:0021:52
- 9 月 24 日 21:0020:52
Harness Engineering 101:编码智能体如何工作
↗ 查看原文 · dev.toDEV Community 发文介绍编码智能体的 harness 概念,指出同一模型在不同 harness 下分别完成…
- 9 月 24 日 20:0019:39
35B 模型与类型化决策模型在 12000 条真实询价单上对比
↗ 查看原文 · dev.to测试对比了类型化决策 API 与一个 35B 模型在 12000 条真实 RFQ 上的表现,主类别准确率分别为 91.9…
- 19:15
421M 参数决策模型在 NVIDIA GPU 上的跑分
↗ 查看原文 · dev.to作者在单张 H100 NVL 上对 421M 参数的决策模型 Laya 做基准测试,称每天可完成 1510 万次决策。
- 19:14
研究者用 LLM 追踪炼金术知识并解读 17 世纪信件
↗ 查看原文 · resobscura.substack.com有历史学者撰文称,借助本周发布的 GPT-6 Sol 与 Opus 5.5,可尝试解决转录之外的历史研究问题,并建议 A…
- 9 月 24 日 19:0018:24
- 9 月 24 日 18:0017:58
- 17:53
- 17:46
MISVO:用 KL 几何约束语言模型干预
↗ 查看原文 · arxiv.org研究者提出 MISVO,在冻结语言模型的最终隐藏状态上做最小侵入式引导向量优化,用局部 KL 几何惩罚干预以抑制分布偏移…
- 17:26
- 17:13
- 9 月 24 日 17:0016:56
- 16:25
观点:Agent 世界模型应编辑对话记录而非模拟终端
↗ 查看原文 · dev.to一篇 DEV 社区文章指出,语言 Agent 的世界模型讨论多直接照搬机器人领域假设,作者主张这类模型应改为编辑对话记录…
- 16:12
SciWalker 用算子图合成科学编程题
↗ 查看原文 · arxiv.org研究者提出 SciWalker 框架,通过算子链采样与执行反馈合成科学编程问题,构建了覆盖5个领域、32个子域的8178…
- 16:10
- 9 月 24 日 16:0015:51
- 15:48
- 15:08
用更少 token 实现 ACE 的 agent 经验复用方案
↗ 查看原文 · dev.to有开发者提出一种思路,让 ACE 与 ALTK-Evolve 这类把 agent 轨迹转成可复用经验的方法在更少 tok…
- 15:05
AI 能否在不加剧故障的前提下诊断 Linux 生产事故?
↗ 查看原文 · dev.to一篇 Kaggle 基准测试挑战投稿,作者对 AI 诊断 Linux 生产事故的能力进行基准测试,关注是否会引入新的问题…
- 9 月 24 日 15:0014:44
- 9 月 24 日 14:0013:40
- 13:17
Env-Rethink:让 LLM Agent 环境自我演化以提升表现
↗ 查看原文 · arxiv.org研究者提出 Env-Rethink,用 27B 后训练模型为 Agent 构建文件收集图与事件日志、识别环境噪声,并通过…
- 13:06
- 9 月 24 日 13:0013:00
- 13:00