跳到主要内容

AI 快讯

LIVE · 24h

全网 AI 动态的中文速报,聚合引擎每 15 分钟更新。

  1. 9 月 20 日 10:00
    09:01

    非自回归规划将 AI Agent 失败率降 25%

    作者分享了一套 AI Agent 非自回归规划架构,称在生产环境中将失败率降低 25%,延迟改善 15%。

    ↗ 查看原文 · dev.to
  2. 9 月 20 日 09:00
    09:00

    .NET 11 RC1 发布:C# 15 转正,联合类型引争议

    .NET 11 RC1 发布,C# 15 从预览转为正式特性,同时引入的联合类型(union types)在社区引发争议…

    ↗ 查看原文 · infoq.cn
  3. 08:30

    APUS 开源国内首批 Jev 跨平台复现成果

    9月19日,APUS 旗下 AI 实验室公布全球最早一批针对 Jev 的独立开源复现成果,称国产模型可实现秒级决策。

    ↗ 查看原文 · qbitai.com
  4. 9 月 20 日 08:00
    07:53

    TypeSafe AI 发布决策模型与记忆模型

    TypeSafe AI 于 9 月 15 日发布一款不会写作的模型,被社区称为 AI 的“拆解时代”。相关讨论围绕其决策…

    ↗ 查看原文 · dev.to
  5. 9 月 19 日 16:00
    15:52

    Show HN:CUA-S1 计算机操作模型开源

    trycua/cua 在 Hacker News 发布 CUA-S1,一个面向计算机操作的系统一模型,配套开源驱动、跨系…

    ↗ 查看原文 · github.com
  6. 9 月 19 日 12:00
    11:43

    Qwen 3.8 用27B模型快速交付网页

    量子位报道称27B规模的Qwen 3.8可一口气完成设计与前端工作,快速交付网页,但后端部分未能完成。

    ↗ 查看原文 · qbitai.com
  7. 9 月 19 日 05:00
    04:44

    NASA 与 IBM 发布开源月球地理空间 AI 模型

    NASA 与 IBM 联合推出面向月球的地理空间 AI 基础模型,并已开源。该模型可用于月球地表数据的分析与识别,具体能…

    ↗ 查看原文 · newsroom.usra.edu
  8. 04:35

    GPT-6 Astra 发布周,Polymarket 上 Anthropic 赔率反升

    OpenAI 发布 GPT-6 Astra 的当周,预测市场 Polymarket 上 Anthropic 的赔率反而上…

    ↗ 查看原文 · dev.to
  9. 9 月 19 日 00:00
    23:54

    阿里达摩院开源医疗AI模型Damo Radar,可识别近150种腹部病变

    阿里达摩院开源视觉语言模型Damo Radar,可分析增强CT识别18个腹部器官的近150种病变,包括恶性肿瘤。在近4万…

    ↗ 查看原文 · scmp.com
  10. 9 月 18 日 19:00
    18:26

    Anthropic 为 Claude Code 加入 AGENTS.md 支持

    Claude Code 2.1.277 起,若文件夹中没有 CLAUDE.md,将自动查找并使用 AGENTS.md,可…

    ↗ 查看原文 · twitter.com
  11. 9 月 18 日 17:00
    16:48

    智谱GLM团队披露RSI进展,GLM-5.3已摸到门槛

    唐杰与GLM团队发长文披露智谱在递归自我改进(RSI)方向的最新进展,称GLM-5.3已摸到门槛。团队在文中表示模型正一…

    ↗ 查看原文 · infoq.cn
  12. 9 月 18 日 13:00
    12:16

    TypeSafe AI 推出决策模型 Jev,完全放弃文本生成

    TypeSafe AI 发布新 AI 决策模型 Jev,不再做文本生成,转向决策任务。目前公开信息有限,具体能力与适用场…

    ↗ 查看原文 · dev.to
  13. 9 月 18 日 09:00
    08:35

    Muse Glimmer 30B:Meta 新中端模型架构与实测

    有开发者撰文分析 Meta 新推出的中端模型 Muse Glimmer 30B,介绍其架构设计并给出上手体验。

    ↗ 查看原文 · dev.to
  14. 9 月 18 日 07:00
    06:43

    Astra 以极小算力解决多个十年老问题

    有文章称 Astra 在 GPT-6 之前就以极小的算力开销解决了多个存在十年的问题,作者认为真正的看点在于成本曲线。

    ↗ 查看原文 · dev.to
  15. 06:43

    OpenAI 为何判定 Astra 太危险不宜开源

    GPT-6 Astra 于 9 月 3 日发布时,OpenAI 将其能力评为 Critical。文章解释了 OpenAI…

    ↗ 查看原文 · dev.to
  16. 9 月 18 日 04:00
    03:48

    7 种注意力机制消融实验:位置影响小,移除关键项代价大

    一项 6.59B MoE 实验在 49 层中放置 7 种序列混合机制并逐一移除,发现位置变化对损失影响仅 0.16%,移…

    ↗ 查看原文 · dev.to
  17. 03:05

    Bonsai 2 27B 将 27B 模型压缩至 5.9GB

    Bonsai 2 27B 把 27B 参数模型压缩到 5.9GB,可在本地运行。来源未给出更多性能细节,能否替代付费订阅…

    ↗ 查看原文 · dev.to
  18. 9 月 18 日 01:00
    00:11

    Cactus 发布 Needle 3:8-29MB 端侧自动化模型

    Cactus 发布面向手机、可穿戴、机器人和微控制器的端侧基础模型 Needle 3,单个 8-29MB 二进制文件,官…

    ↗ 查看原文 · cactuscompute.com
  19. 9 月 17 日 22:00
    21:12

    ChatGPT 联合创造者推出 System One 模型 Jev

    OpenAI 前研究员 Diogo Almeida 用两年做出 Jev,该模型不生成文本,只输出带置信度的类型化决策,输…

    ↗ 查看原文 · dev.to
  20. 21:02

    Atlassian 定制模型 v0.4:25 个应用编译通过 21 个

    基于 Qwen3.8-27B 为 Forge 调优的模型发布 v0.4,应用编译数从 12/25 提升到 21/25,有…

    ↗ 查看原文 · dev.to
  21. 9 月 17 日 21:00
    21:00

    神秘模型 Union Alpha 上线首日消耗 20 亿 Token

    神秘模型 Union Alpha 突然上线,首日跑掉 20 亿 Token,部分网友实测称其性能直逼 Astra。

    ↗ 查看原文 · infoq.cn
  22. 9 月 17 日 16:00
    15:50

    阶跃发布 StepAudio 3 系列语音大模型

    阶跃发布 StepAudio 3 系列语音大模型,覆盖语音识别、语音生成、实时交互与音乐创作四类能力。

    ↗ 查看原文 · infoq.cn
  23. 15:33

    谷歌 Gemini 3.8 Live 瞄准语音 Agent 的沉默时刻

    谷歌推出 Gemini 3.8 Live,主打边说话边推理、边聊天边调用工具,试图解决语音 Agent 在对话中的停顿等…

    ↗ 查看原文 · infoq.cn
  24. 9 月 17 日 13:00
    12:25

    提示词没变,模型却变了:固定版本失效怎么办

    文章指出供应商每隔几个月就发布新模型,原本固定版本的模型会被下线或行为改变,导致同样的提示词输出不同结果。讨论如何应对这…

    ↗ 查看原文 · dev.to
  25. 12:24

    TypeSafe 的 System One 模型 Jev 使用指南

    TypeSafe AI 的前沿模型 Jev 返回带类型的概率性决策,而非普通文本输出。文章给出该模型的实际使用指南。

    ↗ 查看原文 · dev.to
  26. 12:24

    二十个神经音频解码器仅三个真正流式

    一项预注册测试显示,二十个神经音频解码器中只有三个真正支持流式,唯一的音质指标被一个 1984 年的零参数算法击败。

    ↗ 查看原文 · dev.to
  27. 9 月 17 日 09:00
    08:41

    自称ChatGPT共同发明者推出新AI Jev,不输出文字

    一位自称参与发明ChatGPT的人士推出新AI Jev,它只用类型化决策和概率作答,不生成文本,并提供TypeScrip…

    ↗ 查看原文 · dev.to
  28. 08:28

    唐杰发布智谱RSI首个成果

    唐杰发布智谱RSI首个成果,GLM已开始参与构建GLM。

    ↗ 查看原文 · qbitai.com
  29. 9 月 17 日 06:00
    05:54

    330 个模型韩语作答,半数用错字符集

    一项脚本纯度检查在人工评审前自动判负 2304 份回答中的 766 份,54 个模型从未给出过完全干净的韩语回答。

    ↗ 查看原文 · dev.to
  30. 9 月 17 日 04:00
    03:26

    国产RSI模型发布,Flash模型借其反打旗舰

    国产 RSI 模型发布,据称 Flash 模型借助该模型实现对旗舰模型的反超,同时提供 1 亿 Tokens 免费领取。

    ↗ 查看原文 · qbitai.com
  31. 9 月 17 日 02:00
    01:39

    DeepSeek-V4.1 Flash 技术报告:极限压缩 KV Cache

    技术报告显示 DeepSeek-V4.1 Flash 主打 KV Cache 压缩,借鉴 YOCO 使 Prefill…

    ↗ 查看原文 · zartbot.github.io
  32. 9 月 16 日 17:00
    16:06

    新AI模型不生成文本,速度却快100倍

    本周 Hacker News 上讨论最多的发布不是聊天模型,而是一个不写文本的模型,其运行速度比常规方案快 100 倍。

    ↗ 查看原文 · dev.to
  33. 9 月 16 日 16:00
    15:04

    Google 新 Gemini 语音模型改变 Agent 状态管理规则

    Google 发布 Gemini 3.8 Live 与 Extended Thinking,引入异步后台推理能力。对开发…

    ↗ 查看原文 · dev.to
  34. 9 月 16 日 15:00
    14:32

    微软 AI 负责人称 Anthropic 训练方式或对人类有灾难性影响

    微软 AI 负责人 Mustafa Suleyman 警告,Anthropic 将 Claude 当作有意识、应享有自主…

    ↗ 查看原文 · bbc.co.uk
  35. 14:30

    Gemini API 与 AI Studio 上线新版 Live 模型

    谷歌在 Gemini API 和 Google AI Studio 中发布新的 Gemini Live 模型,可用于构建…

    ↗ 查看原文 · dev.to
  36. 14:24

    开发者发布 Swift-Qwen3.8-27B,思考量降 58.3%

    开发者在 Hacker News 的 Show HN 发布 Swift-Qwen3.8-27B,称思考量减少 58.3%…

    ↗ 查看原文 · huggingface.co
  37. 9 月 16 日 14:00
    13:08

    ZDTaichu5.0-9B 国产开源,空间具身智能测试领先

    国产开源模型 ZDTaichu5.0-9B 发布,在九项空间测试中于 10B 规模通用模型里拿下 8 项第一,通用能力未…

    ↗ 查看原文 · qbitai.com
  38. 9 月 16 日 12:00
    11:15

    Nvidia 发布 CUDA Rust,支持用 Rust 写 GPU 内核

    Nvidia 推出 CUDA Rust,含两条路线:cuda-oxide 将 Rust 编写的 SIMT 内核编译为 P…

    ↗ 查看原文 · developer.nvidia.com
  39. 9 月 16 日 07:00
    06:32

    稳准智能联合清华发布LimiX-2,参数升至400M

    9月16日,稳准智能联合清华大学发布新一代数据大模型LimiX-2,参数规模提升至400M,并在国际评测榜单上登顶。

    ↗ 查看原文 · qbitai.com
  40. 06:13

    WFM:面向复杂智能体推理的 Wiki 基础模型

    研究提出 Wiki Foundation Model(WFM),用 Wiki Graph 模式连接细粒度结构与稠密上下文…

    ↗ 查看原文 · arxiv.org
  41. 9 月 16 日 06:00
    05:24

    Qwen 3.8 27B 发布:可在笔记本运行的前沿模型

    有开发者介绍 Qwen 3.8 27B,称其是能跑在笔记本上的前沿大模型,涵盖架构、推理控制与智能体集成。

    ↗ 查看原文 · dev.to
  42. 9 月 16 日 03:00
    02:58

    生数科技发布 Vidu S2,支持实时视频编辑与数字人互动

    生数科技发布 Vidu S2,含实时交互模型 S2-Avatar 与实时视频编辑模型 S2-Editing,可边播边换装…

    ↗ 查看原文 · qbitai.com
  43. 9 月 15 日 23:00
    22:47

    Google 发布 Gemini 3.8 Live 语音模型

    Google 推出 Gemini 3.8 Live 与 3.8 Live Extended Thinking 两款语音到…

    ↗ 查看原文 · simonwillison.net
  44. 9 月 15 日 17:00
    16:52

    OpenAI 发布 GPT-6 Astra,面向编程与计算机应用

    OpenAI 发布 GPT-6 Astra,定位适用于编程和计算机应用场景。目前仅有标题信息,具体能力与开放方式尚未披露…

    ↗ 查看原文 · infoq.cn
  45. 9 月 15 日 11:00
    10:41

    智象发布首款物理规律导向视频模型 HiDream-O1-Video-1.0

    智象未来(HiDream.ai)发布首个原生全模态视频生成模型 HiDream-O1-Video-1.0,主打物理规律导…

    ↗ 查看原文 · qbitai.com
  46. 9 月 15 日 08:00
    07:01

    VIDRAFT 推出 Darwin Factory,一天交付定制 LLM

    韩国 AI 初创公司 VIDRAFT 的 Darwin Factory 通过合并两个开源模型,无需重新训练即可在一天内交…

    ↗ 查看原文 · dev.to
  47. 9 月 15 日 07:00
    06:31

    LLM 数学差并非能力问题,而是它本就没在做数学

    有文章指出,大模型在数学任务上的表现不佳,根源在于它并非真正执行计算,而是在做模式匹配。这一视角影响对模型能力边界的判断…

    ↗ 查看原文 · dev.to
  48. 9 月 14 日 22:00
    21:22

    Anthropic v5 系列提示词实践规则整理

    DEV Community 发文面向云工程师,整理 Anthropic 第五代模型的提示词实践规则,涉及 Sonnet…

    ↗ 查看原文 · dev.to
  49. 9 月 14 日 21:00
    20:31

    Amazon Nova 2 开发者指南:Lite、Pro 与 Omni

    DEV 社区发布 Amazon Nova 2 的开发者指南,介绍该模型家族中 Lite、Pro 和 Omni 三个版本。…

    ↗ 查看原文 · dev.to
  50. 9 月 14 日 17:00
    16:22

    Atria Dawn Preview 发布:面向科研的智能体基础模型

    研究团队推出 Atria Dawn Preview,一个面向科研与工程流程的智能体基础模型,通过可验证经验管线训练。在…

    ↗ 查看原文 · arxiv.org