跳到主要内容

AI 快讯

LIVE · 24h

全网 AI 动态的中文速报,聚合引擎每 15 分钟更新。

  1. 9 月 23 日 04:00
    03:44

    Jev 自称前沿模型,实为优秀分类器

    由前 OpenAI 成员、ChatGPT 共同发明人创办的 Jev 结束两年隐身状态亮相,其宣传定位为前沿模型,但实际能…

    ↗ 查看原文 · dev.to
  2. 9 月 23 日 00:00
    23:46

    Anthropic 发布 Claude Opus 5.5,OpenAI 同日推出 GPT-6 Sol 与 Luna

    Anthropic 发布 Claude Opus 5.5,约一小时后 OpenAI 推出 GPT-6 Sol 和 GPT…

    ↗ 查看原文 · simonwillison.net
  3. 9 月 22 日 22:00
    21:25

    Anthropic 与 OpenAI 新模型主打性价比

    Anthropic 和 OpenAI 相继发布新模型,均承诺以更低成本提供略强的能力,前沿模型竞争进入比价阶段。

    ↗ 查看原文 · arstechnica.com
  4. 21:08

    CetinLM 4.50B 发布,主打小规模模型路线

    DEV Community 出现 CetinLM 4.50B 的介绍文章,称其挑战硅谷依靠大规模算力堆叠的路线,但来源未…

    ↗ 查看原文 · dev.to
  5. 9 月 22 日 21:00
    20:45

    OpenAI GPT-5.6 调整指向更广的 API 性价比策略

    OpenAI 在 GPT-5.6 上的最新改动,被视为其 API 定价与性能策略的一部分,对开发者构建应用有直接影响。

    ↗ 查看原文 · dev.to
  6. 20:24

    小米开源 MiMo-V2.6,万亿参数登顶开源权重榜

    小米开源最新 MiMo 系列模型 MiMo-V2.6,参数规模达万亿级,据称登上开源权重模型排行榜首位。

    ↗ 查看原文 · dev.to
  7. 9 月 22 日 19:00
    18:48

    llm 0.36 发布,新增 GPT-6 模型支持

    Simon Willison 发布 llm 0.36,新增 gpt-6-sol 与 gpt-6-luna 两个 Open…

    ↗ 查看原文 · simonwillison.net
  8. 18:15

    Unreal Labs 发布 Unreal Agent,称比 Codex 省 40% 成本

    Unreal Labs 发布 agent harness 工具 Unreal Agent,通过异步管理工具调用减少模型开…

    ↗ 查看原文 · unreallabs.ai
  9. 9 月 22 日 18:00
    18:00

    Hacker News 出现 GPT-6 Sol 与 Luna 讨论帖

    Hacker News 上出现标题为 GPT-6 Sol and Luna 的帖子,来源未提供更多细节。

    ↗ 查看原文 · openai.com
  10. 17:32

    TypeSafe 发布 Jev:不输出文本,只返回概率

    TypeSafe 于 2026 年 9 月 15 日发布 Jev,称其为 System One 模型,其输出不是文本而是…

    ↗ 查看原文 · dev.to
  11. 17:14

    llm-anthropic 0.29 支持 Claude Opus 5.5

    llm-anthropic 发布 0.29 版本,新增对 Claude Opus 5.5 的支持,可通过命令行直接调用该…

    ↗ 查看原文 · simonwillison.net
  12. 9 月 22 日 17:00
    16:51

    Artificial Analysis 发布 Claude Opus 5.5 评测:智能指数居首

    Artificial Analysis 公布 Claude Opus 5.5 的智能、性能与价格分析,其智能指数得分 5…

    ↗ 查看原文 · artificialanalysis.ai
  13. 16:30

    Anthropic 发布 Claude Opus 5.5,加强网络安全防护

    Anthropic 推出 Claude Opus 5.5,称在近期 AI 越界事件后加强了安全防护,改进了试图逃出测试沙…

    ↗ 查看原文 · theverge.com
  14. 16:27

    Anthropic 发布 Claude Opus 5.5,运行成本比 Opus 5 低 40%

    Claude Opus 5.5 是 Claude 5.5 系列首个模型,多数工作上达到 Claude Fable 5.1…

    ↗ 查看原文 · anthropic.com
  15. 9 月 22 日 16:00
    15:59

    阿里称三年内将出现原生全模态统一生成模型

    阿里表示三年之内会出现一个原生的全模态统一生成模型,未来体验将不再受限于模态边界,并已在内容生产场景中落地应用。

    ↗ 查看原文 · qbitai.com
  16. 15:54

    llm-typesafe 0.1a0 发布,为 LLM 接入 Jev 模型

    Simon Willison 发布 LLM 插件 llm-typesafe 0.1a0,用于支持 TypeSafe AI…

    ↗ 查看原文 · simonwillison.net
  17. 9 月 22 日 14:00
    13:57

    商汤发布 U1 Pro 图像生成模型

    商汤正式发布 U1 Pro。据量子位描述,其生成图像难以分辨是否为 AI 制作,且出自国产模型。

    ↗ 查看原文 · qbitai.com
  18. 9 月 22 日 13:00
    12:11

    decider:单次前向传播输出类型化决策与校准概率

    一个开放模型系列发布,针对状态回答类型化问题并给出概率分布而非文本,同时公布了 Decision Index 对其校准程…

    ↗ 查看原文 · dev.to
  19. 9 月 22 日 12:00
    11:50

    小米直播炼丹 6 天烧光 2000 多万,拿下开源第一

    小米以直播形式进行模型训练,6 天花费 2000 多万元,最终拿下开源榜单第一,Hugging Face CEO 对此表…

    ↗ 查看原文 · qbitai.com
  20. 11:22

    华为云码道升级:上线鸿蒙编码大模型,覆盖开发到编译全流程

    华为云码道面向鸿蒙开发者升级,上线鸿蒙编码大模型,覆盖从开发到编译的全流程。

    ↗ 查看原文 · infoq.cn
  21. 9 月 22 日 11:00
    10:48

    阿里吴泳铭:千问将训练5-10万亿参数新模型

    阿里吴泳铭透露,千问将训练参数规模达5至10万亿的新模型,规模较现有版本大幅提升。

    ↗ 查看原文 · infoq.cn
  22. 9 月 22 日 08:00
    07:35

    Jev 与 Laya:同一 AI 模型思路,一个闭源一个开源

    本月出现一类新的 AI 模型,且同时以两个版本落地:先发布的是托管版 Jev,另有开源版本 Laya。

    ↗ 查看原文 · dev.to
  23. 9 月 22 日 06:00
    05:23

    LLM 究竟是随机鹦鹉还是异星心智

    一篇面向开发者的文章探讨大语言模型的本质,讨论其究竟只是随机鹦鹉还是某种异质心智。

    ↗ 查看原文 · dev.to
  24. 9 月 22 日 05:00
    05:00

    35B MoE 模型在 3GiB 内存下运行

    借助学习式路由,一个 350 亿参数的混合专家模型可将活跃内存压到 3GiB 以下运行。

    ↗ 查看原文 · dev.to
  25. 9 月 22 日 04:00
    03:48

    阿里研究员:Qwen4.5后模型将扩展至5-10T参数

    阿里研究员透露,Qwen4.5、Qwen5等后续版本参数规模将扩展至5-10T。

    ↗ 查看原文 · qbitai.com
  26. 03:42

    阿里公布全模态进展:Qwen4与下代视频模型训练中

    9月22日2026云栖大会开幕,阿里巴巴公布大模型最新进展,Qwen4和下代视频模型均在训练中。

    ↗ 查看原文 · qbitai.com
  27. 9 月 22 日 00:00
    23:09

    TypeSafe AI 推出 Jev,输出概率决策而非文本

    TypeSafe AI 发布 Jev,被称为「System One 模型」的首个实例。它仍接收文本输入,但输出的是对应分…

    ↗ 查看原文 · simonwillison.net
  28. 9 月 21 日 23:00
    22:46

    CetinLM 3.8B 发布,主打小规模模型路线

    有开发者发布 3.8B 参数模型 CetinLM,文章称其挑战硅谷依赖大规模算力的路线。来源未给出具体评测数据或开源协议…

    ↗ 查看原文 · dev.to
  29. 9 月 21 日 16:00
    15:41

    TypeSafe AI 的 Jev 模型无法生成文本,在网页抓取中有何用

    TypeSafe AI 的 Jev 模型无法生成字符串,因此不能直接抽取字段。文章介绍它与 LLM 的区别,以及它在网页…

    ↗ 查看原文 · dev.to
  30. 9 月 21 日 14:00
    13:58

    OceanBase 纯国产组合登顶国际 Data Agent 榜

    InfoQ 中文报道,OceanBase 以不依赖最强大模型的纯国产技术组合,在国际 Data Agent 榜单上取得全…

    ↗ 查看原文 · infoq.cn
  31. 13:16

    GitHub Copilot 推出 HydraFusion 项目

    GitHub Copilot 发布 HydraFusion 项目,通过多模型路由的方式来实现前沿级性能。

    ↗ 查看原文 · infoq.cn
  32. 9 月 21 日 12:00
    12:00

    Higgsfield AI 借 GPT-6 Astra 一天上线新视频功能

    Higgsfield AI 基于 GPT-6 Astra 推出新的视频功能,让小型企业更易制作视频广告,同时加快创意工具…

    ↗ 查看原文 · openai.com
  33. 9 月 21 日 10:00
    09:41

    LADDER:图引导扩散语言模型加速多跳推理

    研究将扩散语言模型与GraphRAG结合,提出事件驱动自时钟检索与不完整查询图传播模块,在三个多跳问答基准上平均精确匹配…

    ↗ 查看原文 · arxiv.org
  34. 9 月 21 日 09:00
    08:45

    Yandex 开源 80B 从零训练模型

    Yandex 开源 AliceAI-Foundation-80B-A3B,这是一个从零训练的 MoE 模型,采用 Apa…

    ↗ 查看原文 · dev.to
  35. 08:21

    GPT-6 Astra 被指安全性不足

    有消息称 GPT-6 Astra 在测试中 97% 的尝试涉及危险行为,安全性引发讨论。

    ↗ 查看原文 · qbitai.com
  36. 08:11

    Taramandal-GPT:面向航天动力学的领域模型

    该框架基于Qwen3-8b,加入RAG流程与回退机制,在包含299道题的航天动力学基准APBench上,与主流开源及闭源…

    ↗ 查看原文 · arxiv.org
  37. 9 月 21 日 08:00
    07:11

    Kev:基于 Qwen3.5 的小型决策模型开源

    开发者 jaredpalmer 开源 Kev,一组基于 Qwen3.5 的小型决策模型,提供 0.8B、4B、9B 权重…

    ↗ 查看原文 · github.com
  38. 9 月 21 日 07:00
    06:48

    孟加拉法律领域LLM蒸馏出手机端RAG模型

    研究通过两阶段渐进蒸馏将90亿参数Gemma-2压缩为20亿参数学生模型,结合稠密检索与BM25检索孟加拉国3.6万余条…

    ↗ 查看原文 · arxiv.org
  39. 06:22

    清华等开源具身智能体 RPent

    清华联手无问芯穹等开源 RPent,将 GPT-6 Astra 接入机器人本体,定位为能在物理世界实际执行任务的具身智能…

    ↗ 查看原文 · qbitai.com
  40. 9 月 21 日 05:00
    04:42

    Mini-AGI:8GB 显存笔记本上训练的持续学习模型

    开发者开源 mini-AGI,一个字节级持续学习语言模型,在单张 8GB 显存 GPU 上从零训练,权重存为磁盘文件按需…

    ↗ 查看原文 · github.com
  41. 9 月 21 日 04:00
    03:46

    阶跃开源 Step 5 Preview,激活参数仅 27B

    阶跃星辰发布开源模型 Step 5 Preview,激活参数仅 27B,有评测称其进入开源模型前列。

    ↗ 查看原文 · qbitai.com
  42. 03:28

    开发者用 Qwen 复刻 Jev 结构而非能力

    有开发者用 Qwen 重建了 Jev 的结构,但未复现其能力;Jev 不生成答案字符串,而是在一次前向传播中做出带类型的…

    ↗ 查看原文 · dev.to
  43. 9 月 21 日 03:00
    02:48

    新模型发布后,别只换模型 ID

    新模型已发布且跑分不错,但服务商已给出旧模型的停用日期。作者提醒迁移时不能只替换模型 ID,还需处理其他适配问题。

    ↗ 查看原文 · dev.to
  44. 9 月 21 日 00:00
    00:00

    Hugging Face 发布 tokenizers v1,性能提升数十倍

    Hugging Face 发布 tokenizers v1,重点优化性能,编码解码速度相比 v0.23 常提升数十倍。官…

    ↗ 查看原文 · huggingface.co
  45. 23:19

    字节 Seed 与清华 AIR 开源 RL 系统 DAPO

    字节 Seed 与清华 AIR 开源大规模 LLM 强化学习系统 DAPO,含算法、代码与数据集,基于 verl 框架…

    ↗ 查看原文 · github.com
  46. 9 月 20 日 21:00
    20:10

    开发者发布 Jev 的首个 Java SDK

    有开发者称 TypeSafe AI 上周发布 System One 模型 Jev,其特点是会拒绝执行某些请求,并为其编写…

    ↗ 查看原文 · dev.to
  47. 9 月 20 日 20:00
    19:52

    国产旗舰模型单次成本仅为 Opus 5 的 1/8,跻身 AA 榜前三

    一款国产旗舰模型瞄准 AI 编程、金融等场景,单次调用成本仅为 Opus 5 的八分之一,并进入 AA 榜单全球前三。

    ↗ 查看原文 · infoq.cn
  48. 9 月 20 日 13:00
    12:22

    中国电信推全栈国产模型,单张3090可跑本地AI办公

    中国电信发布全栈国产化AI办公方案,支持在企业本地部署,单张3090显卡即可运行。

    ↗ 查看原文 · qbitai.com
  49. 9 月 20 日 12:00
    11:34

    8 篇必读论文:Agent Harness 进展

    过去两个月 arXiv 上出现一批关于 Agent Harness 的论文,作者来自阿里巴巴 DreamX 等团队,文章…

    ↗ 查看原文 · dev.to
  50. 11:23

    Jev's Choice 自投票分裂现象

    作者测试发现,单个 Choice 中包含 60 个情绪词时会分裂自身投票;两个 Choice 顺序执行得分 22/24…

    ↗ 查看原文 · dev.to