AI 快讯
LIVE · 24h全网 AI 动态的中文速报,聚合引擎每 15 分钟更新。
- 9 月 20 日 10:0009:01
- 9 月 20 日 09:0009:00
.NET 11 RC1 发布:C# 15 转正,联合类型引争议
↗ 查看原文 · infoq.cn.NET 11 RC1 发布,C# 15 从预览转为正式特性,同时引入的联合类型(union types)在社区引发争议…
- 08:30
APUS 开源国内首批 Jev 跨平台复现成果
↗ 查看原文 · qbitai.com9月19日,APUS 旗下 AI 实验室公布全球最早一批针对 Jev 的独立开源复现成果,称国产模型可实现秒级决策。
- 9 月 20 日 08:0007:53
- 9 月 19 日 16:0015:52
Show HN:CUA-S1 计算机操作模型开源
↗ 查看原文 · github.comtrycua/cua 在 Hacker News 发布 CUA-S1,一个面向计算机操作的系统一模型,配套开源驱动、跨系…
- 9 月 19 日 12:0011:43
- 9 月 19 日 05:0004:44
NASA 与 IBM 发布开源月球地理空间 AI 模型
↗ 查看原文 · newsroom.usra.eduNASA 与 IBM 联合推出面向月球的地理空间 AI 基础模型,并已开源。该模型可用于月球地表数据的分析与识别,具体能…
- 04:35
GPT-6 Astra 发布周,Polymarket 上 Anthropic 赔率反升
↗ 查看原文 · dev.toOpenAI 发布 GPT-6 Astra 的当周,预测市场 Polymarket 上 Anthropic 的赔率反而上…
- 9 月 19 日 00:0023:54
阿里达摩院开源医疗AI模型Damo Radar,可识别近150种腹部病变
↗ 查看原文 · scmp.com阿里达摩院开源视觉语言模型Damo Radar,可分析增强CT识别18个腹部器官的近150种病变,包括恶性肿瘤。在近4万…
- 9 月 18 日 19:0018:26
Anthropic 为 Claude Code 加入 AGENTS.md 支持
↗ 查看原文 · twitter.comClaude Code 2.1.277 起,若文件夹中没有 CLAUDE.md,将自动查找并使用 AGENTS.md,可…
- 9 月 18 日 17:0016:48
智谱GLM团队披露RSI进展,GLM-5.3已摸到门槛
↗ 查看原文 · infoq.cn唐杰与GLM团队发长文披露智谱在递归自我改进(RSI)方向的最新进展,称GLM-5.3已摸到门槛。团队在文中表示模型正一…
- 9 月 18 日 13:0012:16
TypeSafe AI 推出决策模型 Jev,完全放弃文本生成
↗ 查看原文 · dev.toTypeSafe AI 发布新 AI 决策模型 Jev,不再做文本生成,转向决策任务。目前公开信息有限,具体能力与适用场…
- 9 月 18 日 09:0008:35
Muse Glimmer 30B:Meta 新中端模型架构与实测
↗ 查看原文 · dev.to有开发者撰文分析 Meta 新推出的中端模型 Muse Glimmer 30B,介绍其架构设计并给出上手体验。
- 9 月 18 日 07:0006:43
- 06:43
OpenAI 为何判定 Astra 太危险不宜开源
↗ 查看原文 · dev.toGPT-6 Astra 于 9 月 3 日发布时,OpenAI 将其能力评为 Critical。文章解释了 OpenAI…
- 9 月 18 日 04:0003:48
7 种注意力机制消融实验:位置影响小,移除关键项代价大
↗ 查看原文 · dev.to一项 6.59B MoE 实验在 49 层中放置 7 种序列混合机制并逐一移除,发现位置变化对损失影响仅 0.16%,移…
- 03:05
Bonsai 2 27B 将 27B 模型压缩至 5.9GB
↗ 查看原文 · dev.toBonsai 2 27B 把 27B 参数模型压缩到 5.9GB,可在本地运行。来源未给出更多性能细节,能否替代付费订阅…
- 9 月 18 日 01:0000:11
Cactus 发布 Needle 3:8-29MB 端侧自动化模型
↗ 查看原文 · cactuscompute.comCactus 发布面向手机、可穿戴、机器人和微控制器的端侧基础模型 Needle 3,单个 8-29MB 二进制文件,官…
- 9 月 17 日 22:0021:12
ChatGPT 联合创造者推出 System One 模型 Jev
↗ 查看原文 · dev.toOpenAI 前研究员 Diogo Almeida 用两年做出 Jev,该模型不生成文本,只输出带置信度的类型化决策,输…
- 21:02
Atlassian 定制模型 v0.4:25 个应用编译通过 21 个
↗ 查看原文 · dev.to基于 Qwen3.8-27B 为 Forge 调优的模型发布 v0.4,应用编译数从 12/25 提升到 21/25,有…
- 9 月 17 日 21:0021:00
神秘模型 Union Alpha 上线首日消耗 20 亿 Token
↗ 查看原文 · infoq.cn神秘模型 Union Alpha 突然上线,首日跑掉 20 亿 Token,部分网友实测称其性能直逼 Astra。
- 9 月 17 日 16:0015:50
- 15:33
谷歌 Gemini 3.8 Live 瞄准语音 Agent 的沉默时刻
↗ 查看原文 · infoq.cn谷歌推出 Gemini 3.8 Live,主打边说话边推理、边聊天边调用工具,试图解决语音 Agent 在对话中的停顿等…
- 9 月 17 日 13:0012:25
- 12:24
TypeSafe 的 System One 模型 Jev 使用指南
↗ 查看原文 · dev.toTypeSafe AI 的前沿模型 Jev 返回带类型的概率性决策,而非普通文本输出。文章给出该模型的实际使用指南。
- 12:24
- 9 月 17 日 09:0008:41
自称ChatGPT共同发明者推出新AI Jev,不输出文字
↗ 查看原文 · dev.to一位自称参与发明ChatGPT的人士推出新AI Jev,它只用类型化决策和概率作答,不生成文本,并提供TypeScrip…
- 08:28
- 9 月 17 日 06:0005:54
- 9 月 17 日 04:0003:26
国产RSI模型发布,Flash模型借其反打旗舰
↗ 查看原文 · qbitai.com国产 RSI 模型发布,据称 Flash 模型借助该模型实现对旗舰模型的反超,同时提供 1 亿 Tokens 免费领取。
- 9 月 17 日 02:0001:39
DeepSeek-V4.1 Flash 技术报告:极限压缩 KV Cache
↗ 查看原文 · zartbot.github.io技术报告显示 DeepSeek-V4.1 Flash 主打 KV Cache 压缩,借鉴 YOCO 使 Prefill…
- 9 月 16 日 17:0016:06
- 9 月 16 日 16:0015:04
Google 新 Gemini 语音模型改变 Agent 状态管理规则
↗ 查看原文 · dev.toGoogle 发布 Gemini 3.8 Live 与 Extended Thinking,引入异步后台推理能力。对开发…
- 9 月 16 日 15:0014:32
微软 AI 负责人称 Anthropic 训练方式或对人类有灾难性影响
↗ 查看原文 · bbc.co.uk微软 AI 负责人 Mustafa Suleyman 警告,Anthropic 将 Claude 当作有意识、应享有自主…
- 14:30
Gemini API 与 AI Studio 上线新版 Live 模型
↗ 查看原文 · dev.to谷歌在 Gemini API 和 Google AI Studio 中发布新的 Gemini Live 模型,可用于构建…
- 14:24
开发者发布 Swift-Qwen3.8-27B,思考量降 58.3%
↗ 查看原文 · huggingface.co开发者在 Hacker News 的 Show HN 发布 Swift-Qwen3.8-27B,称思考量减少 58.3%…
- 9 月 16 日 14:0013:08
ZDTaichu5.0-9B 国产开源,空间具身智能测试领先
↗ 查看原文 · qbitai.com国产开源模型 ZDTaichu5.0-9B 发布,在九项空间测试中于 10B 规模通用模型里拿下 8 项第一,通用能力未…
- 9 月 16 日 12:0011:15
Nvidia 发布 CUDA Rust,支持用 Rust 写 GPU 内核
↗ 查看原文 · developer.nvidia.comNvidia 推出 CUDA Rust,含两条路线:cuda-oxide 将 Rust 编写的 SIMT 内核编译为 P…
- 9 月 16 日 07:0006:32
稳准智能联合清华发布LimiX-2,参数升至400M
↗ 查看原文 · qbitai.com9月16日,稳准智能联合清华大学发布新一代数据大模型LimiX-2,参数规模提升至400M,并在国际评测榜单上登顶。
- 06:13
WFM:面向复杂智能体推理的 Wiki 基础模型
↗ 查看原文 · arxiv.org研究提出 Wiki Foundation Model(WFM),用 Wiki Graph 模式连接细粒度结构与稠密上下文…
- 9 月 16 日 06:0005:24
- 9 月 16 日 03:0002:58
生数科技发布 Vidu S2,支持实时视频编辑与数字人互动
↗ 查看原文 · qbitai.com生数科技发布 Vidu S2,含实时交互模型 S2-Avatar 与实时视频编辑模型 S2-Editing,可边播边换装…
- 9 月 15 日 23:0022:47
Google 发布 Gemini 3.8 Live 语音模型
↗ 查看原文 · simonwillison.netGoogle 推出 Gemini 3.8 Live 与 3.8 Live Extended Thinking 两款语音到…
- 9 月 15 日 17:0016:52
OpenAI 发布 GPT-6 Astra,面向编程与计算机应用
↗ 查看原文 · infoq.cnOpenAI 发布 GPT-6 Astra,定位适用于编程和计算机应用场景。目前仅有标题信息,具体能力与开放方式尚未披露…
- 9 月 15 日 11:0010:41
智象发布首款物理规律导向视频模型 HiDream-O1-Video-1.0
↗ 查看原文 · qbitai.com智象未来(HiDream.ai)发布首个原生全模态视频生成模型 HiDream-O1-Video-1.0,主打物理规律导…
- 9 月 15 日 08:0007:01
VIDRAFT 推出 Darwin Factory,一天交付定制 LLM
↗ 查看原文 · dev.to韩国 AI 初创公司 VIDRAFT 的 Darwin Factory 通过合并两个开源模型,无需重新训练即可在一天内交…
- 9 月 15 日 07:0006:31
LLM 数学差并非能力问题,而是它本就没在做数学
↗ 查看原文 · dev.to有文章指出,大模型在数学任务上的表现不佳,根源在于它并非真正执行计算,而是在做模式匹配。这一视角影响对模型能力边界的判断…
- 9 月 14 日 22:0021:22
- 9 月 14 日 21:0020:31
Amazon Nova 2 开发者指南:Lite、Pro 与 Omni
↗ 查看原文 · dev.toDEV 社区发布 Amazon Nova 2 的开发者指南,介绍该模型家族中 Lite、Pro 和 Omni 三个版本。…
- 9 月 14 日 17:0016:22
Atria Dawn Preview 发布:面向科研的智能体基础模型
↗ 查看原文 · arxiv.org研究团队推出 Atria Dawn Preview,一个面向科研与工程流程的智能体基础模型,通过可验证经验管线训练。在…