跳到主要内容

AI 快讯

LIVE · 24h

全网 AI 动态的中文速报,聚合引擎每 15 分钟更新。

  1. 9 月 17 日 08:00
    07:37

    开发者讨论:工具描述就是契约

    DEV Community 系列文章指出,MCP 与 REST 是通往同一厨房的两扇门,并强调工具描述本身就是契约。该系…

    ↗ 查看原文 · dev.to
  2. 07:33

    在 EKS 上安装配置 Kubeflow 做机器学习

    有开发者发布教程,介绍如何在 EKS 上安装并配置 Kubeflow,用于机器学习工作流。Kubeflow 被比作机器学…

    ↗ 查看原文 · dev.to
  3. 07:14

    用 MCP 把产品反馈转成开发任务

    有开发者介绍如何借助 MCP 将分散在各处的客户反馈自动整理为开发任务,减少反馈与开发工作之间的手动搬运。

    ↗ 查看原文 · dev.to
  4. 07:06

    不依赖单帧评估 AI 生成视频的镜头运动

    有文章指出,仅凭最好看的一帧来评判 AI 生成视频存在问题,并提出不依赖单帧来评估镜头运动的方法。

    ↗ 查看原文 · dev.to
  5. 07:04

    开发者分享开源之路:从许可证变更到首个 PR

    一位开发者在 DEV Community 发文,讲述自己受 Madelyn Olson 播客启发后参与开源、提交首个 P…

    ↗ 查看原文 · dev.to
  6. 9 月 17 日 07:00
    07:00

    用可中断GPU容量跑训练,成本仅为按需价格的18%

    有开发者分享经验称,若为渲染或训练按需付费购买GPU,成本偏高;改用可中断容量后,价格约为按需实例的18%。

    ↗ 查看原文 · dev.to
  7. 06:47

    实验:给模型看旧代码,32 次运行 0% 复用

    开发者用同一任务、同一模型分别基于迁移前后两个提交做实验。旧提交下每次运行都手写约 190 行 typeahead 并复…

    ↗ 查看原文 · dev.to
  8. 06:44

    开发者构建LLM调优器,基准测试四次推翻自身结论

    一位开发者分享其LLM调优器的基准测试经历,该工具选出的配置运行速度提升近四倍,但测试过程四次推翻了原有判断。

    ↗ 查看原文 · dev.to
  9. 06:37

    死锁不会因为重试次数多而消失

    文章指出,一个本身需要容量才能运行的容量问题解决方案,不是被延迟,而是陷入死锁,重试再多也无济于事。

    ↗ 查看原文 · dev.to
  10. 06:34

    建议在发布 Agent 排行榜前先冻结评测清单

    文章指出,只有先固定数据集、指标函数和对照运行,公布的 Agent 分数才可信,否则排行榜结果难以复现和比较。

    ↗ 查看原文 · dev.to
  11. 06:28

    AI 让翻译变便宜,难的是决定保留哪套架构

    一位开发者分享其 Codenames AI 网页游戏的架构取舍经验,指出 AI 降低翻译成本后,真正的难点在于判断哪些架…

    ↗ 查看原文 · dev.to
  12. 06:07

    MIT开源TypeScript层:用Jev先给OpenTelemetry日志打分再交给大模型

    一个MIT许可的TypeScript层借助TypeSafe的Jev对OpenTelemetry日志打分、排序和路由,保留…

    ↗ 查看原文 · dev.to
  13. 9 月 17 日 06:00
    05:54

    330 个模型韩语作答,半数用错字符集

    一项脚本纯度检查在人工评审前自动判负 2304 份回答中的 766 份,54 个模型从未给出过完全干净的韩语回答。

    ↗ 查看原文 · dev.to
  14. 05:48

    UNote:把笔记存进私有 Git 仓库的桌面应用

    开发者推出 Git-first 桌面笔记应用 UNote,笔记以真实文件形式存放在用户的私有 Git 仓库中,应用只负责…

    ↗ 查看原文 · dev.to
  15. 05:45

    fail-closed 会计工作流:n8n、TypeScript 与 Conta 试点

    文章讨论会计工作流中流程成功执行却未得出有效会计结论的问题,介绍如何用 n8n 与 TypeScript 构建 fail…

    ↗ 查看原文 · dev.to
  16. 05:34

    Kubelet监控inode,但往往到告急才反应

    文章描述工作节点触发NodeFilesystemFilesFillingUp告警、inode即将耗尽的场景,讨论Kube…

    ↗ 查看原文 · dev.to
  17. 05:29

    在 AWS 上搭建自愈多可用区基础设施的实践记录

    一位开发者分享了在 AWS 上构建自愈、多可用区基础设施的过程,并记录了搭建途中遇到的问题。

    ↗ 查看原文 · dev.to
  18. 05:27

    LearnActCoder 用角色感知错误记忆改进临床编码

    论文提出 Learn-Then-Act 框架,把少量标注样本中的错误整理成结构化错误知识库,并按假阴性、假阳性分别路由给…

    ↗ 查看原文 · arxiv.org
  19. 05:04

    一行修复上线,背后是三周未发布的工作

    周五晚八点半左右,移动端 API 在某个环节开始返回错误,最终上线的修复只有一行,但依赖了三周尚未发布的改动。

    ↗ 查看原文 · dev.to
  20. 9 月 17 日 05:00
    05:00

    零训练语音接入:冻结视觉语言主干即可获得音频能力

    有开发者提出在冻结的视觉语言主干上直接加入离散语音 token,无需训练就能获得可用的音频能力,同时保留原有视觉语言性能…

    ↗ 查看原文 · dev.to
  21. 04:48

    新增廉价节点池,半数容量跑不起自家镜像

    团队周二新增一批更便宜的实例节点池,每小时成本低三分之一,但其中一半新容量无法运行自家镜像。

    ↗ 查看原文 · dev.to
  22. 04:48

    在 Cloudflare 上用 Next.js Worker 部署 ONNX 抠图容器

    有开发者将 ONNX 背景移除容器放在 Cloudflare 的 Next.js Worker 之后运行,用于在边缘侧完…

    ↗ 查看原文 · dev.to
  23. 04:44

    审查生成的 Terraform:销毁数量、count 与 for_each 及错位注释

    作者指出 Terraform 是最不适合直接接受生成代码的场景,并列举了审查时需注意的销毁数量、count 与 for_…

    ↗ 查看原文 · dev.to
  24. 04:43

    团队刻意让每次 apply 都是小改动

    作者回顾春季一次事故中需要紧急提高连接数上限,借此说明团队为何刻意把每次 apply 控制在小范围。

    ↗ 查看原文 · dev.to
  25. 04:37

    马斯克为AI基建住进工地

    马斯克为推进AI基础设施建设住进施工现场,据称这次的条件是有一辆房车。

    ↗ 查看原文 · qbitai.com
  26. 04:36

    Cloudflare 开源 security-audit 编码代理安全审计技能

    Cloudflare 在 GitHub 开源 security-audit-skill,让编码代理分六个阶段执行安全审计…

    ↗ 查看原文 · github.com
  27. 04:30

    两天内核调试,问题出在一个默认值

    浏览器端训练损失长期停在 2.45 附近,曲线平滑得像是模型或数据问题,最终排查发现根源是一个默认参数设置。

    ↗ 查看原文 · dev.to
  28. 9 月 17 日 04:00
    03:59

    有人让 AI 规划 170 项改动,发现它每次都犯同样 3 个错误

    一位开发者用 AI 完成 170 个规划目标,发现模型反复出现相同的三类错误,问题不在模型选择上。

    ↗ 查看原文 · dev.to
  29. 03:56

    PrefixBench-H100:H100 上前缀复用与首字延迟基准

    论文提出 PrefixBench-H100,在单张 H100 上测量 vLLM 与 TensorRT-LLM 的前缀复用…

    ↗ 查看原文 · arxiv.org
  30. 03:39

    天工工作台联合火山引擎推出双节促销

    SkyProduction(天工工作台)与火山引擎 Seedance 2.5 自 9 月 15 日起推出中秋国庆特惠活动…

    ↗ 查看原文 · qbitai.com
  31. 03:27

    多模态 RAG 框架用于科学图像质量评估

    论文提出面向科学图像质量评估的检索增强生成框架,构建融合文本语义与细粒度视觉特征的多模态索引,并设计多路检索融合机制。该…

    ↗ 查看原文 · arxiv.org
  32. 03:26

    国产RSI模型发布,Flash模型借其反打旗舰

    国产 RSI 模型发布,据称 Flash 模型借助该模型实现对旗舰模型的反超,同时提供 1 亿 Tokens 免费领取。

    ↗ 查看原文 · qbitai.com
  33. 03:17

    Chunkless RAG 是否解决了真问题

    IBM 近期推广名为 Chunkless RAG 的方案,在中文 AI 开发者圈引发讨论,文章质疑其是否针对了检索增强生…

    ↗ 查看原文 · dev.to
  34. 03:16

    为什么「去背景」不是视频处理的正确思路

    有开发者指出,把视频直接丢进图像去背景工具再导出,效果往往不理想,因为视频与静态图的处理逻辑并不相同。

    ↗ 查看原文 · dev.to
  35. 03:12

    browser-use 开源 Jev Ultrafast 浏览器智能体

    browser-use 发布 Jev Ultrafast,采用动态索引动作空间,每次观测生成元素表,模型只需选择操作与目…

    ↗ 查看原文 · github.com
  36. 03:08

    DataCanvas-EDU:教学场景合成数据生成框架

    论文发布 DataCanvas-EDU,教师通过对话说明教学目标与数据模式,AI 智能体负责生成代码、校验数据并准备作业…

    ↗ 查看原文 · arxiv.org
  37. 03:07

    提示词结构复杂度指数与代码生成可靠性研究

    论文提出在生成前打分的六维提示词结构复杂度指数,用 5000 条 Python 提示词、21 个模型共 10.5 万次生…

    ↗ 查看原文 · arxiv.org
  38. 03:06

    自托管 CI Runner 的安全威胁建模

    DEV Community 发文对自托管 CI runner 做威胁建模,梳理了从 fork 拉取请求到获取生产环境访问…

    ↗ 查看原文 · dev.to
  39. 9 月 17 日 03:00
    03:00

    开源重定向防护库 0.3.0 修复漏洞时引入新漏洞

    一个开源重定向校验库在 0.3.0 版本中修复了一处开放重定向问题,但拒绝逻辑的兜底实现又把同一字符串交还浏览器,导致新…

    ↗ 查看原文 · dev.to
  40. 02:43

    MI300X 实测:矩阵核心跑什么、不跑什么

    作者在 AMD Developer Cloud 上用一台 MI300X 通过 MCP 服务实测:fp8 e4m3fnuz…

    ↗ 查看原文 · dev.to
  41. 02:42

    DeltaSelect:面向编码智能体的低成本 A/B 测试

    论文提出开源方法 DeltaSelect,通过皮尔逊相关筛选能稳定反映全量基准表现的任务,并按预算固定任务集,用于开发中…

    ↗ 查看原文 · arxiv.org
  42. 02:22

    开发者分享参加 HackerRank Orchestrate 被 AI 评委面试的经历

    一名开发者参加 HackerRank Orchestrate 比赛,原本想拿名次,结果被 AI 评委追问 Praxi C…

    ↗ 查看原文 · dev.to
  43. 02:19

    机器人数据集空闲检测改用逐回合自适应阈值

    开发者回应 GitHub Issue 中关于“最小状态变化”判定的疑问,说明其机器人数据集空闲检测方案选择按每个回合使用…

    ↗ 查看原文 · dev.to
  44. 02:14

    研究:Claude Code 与 Codex 拦截监控可被注入攻击绕过

    研究对 Claude Code 的 Auto Mode 和 OpenAI Codex 的 Guardian 做红队测试…

    ↗ 查看原文 · arxiv.org
  45. 02:09

    Fuse:给终端加上无限画布

    DEV Community 介绍了一个名为 Fuse 的终端工具,主张用无限画布替代项目里越积越多的零散 shell 脚…

    ↗ 查看原文 · dev.to
  46. 02:06

    Go 语言轻量 AI Agent:Baize 架构与取舍

    DEV Community 发文介绍 Baize,一个以单进程 sidecar 形式运行的 AI 助手运行时,文章重点讨…

    ↗ 查看原文 · dev.to
  47. 02:01

    比亚迪李云飞:中国汽车首登世界第一

    9月13日,2026比亚迪粉丝嘉年华在深圳坪山体育馆举行,比亚迪李云飞在会上表示中国汽车首次登上世界第一,并称这份荣耀属…

    ↗ 查看原文 · qbitai.com
  48. 9 月 17 日 02:00
    01:56

    AI 代理自动完成遗传病严重程度分类

    研究者用 ReAct 结合 RAG 构建自主代理,依据 ACMG 与 ACOG 标准检索 PubMed 文献,对 102…

    ↗ 查看原文 · arxiv.org
  49. 01:55

    网易有道周枫:AI竞争进入Model+Agent+Workflow时代

    9月16日,网易有道在北京举办「NEXT,AGENT|有道AI Open Day」,周枫在会上表示AI能力竞争正进入「M…

    ↗ 查看原文 · qbitai.com
  50. 01:53

    开发者实测编码 Agent 是否遵守规则

    一位开发者记录了自己的编码 Agent 在同一段对话中四次犯同样错误,持续通过 shell 写文件,并据此测量 Agen…

    ↗ 查看原文 · dev.to