AI 快讯
LIVE · 24h全网 AI 动态的中文速报,聚合引擎每 15 分钟更新。
- 9 月 23 日 04:0003:44
- 9 月 23 日 00:0023:46
Anthropic 发布 Claude Opus 5.5,OpenAI 同日推出 GPT-6 Sol 与 Luna
↗ 查看原文 · simonwillison.netAnthropic 发布 Claude Opus 5.5,约一小时后 OpenAI 推出 GPT-6 Sol 和 GPT…
- 9 月 22 日 22:0021:25
Anthropic 与 OpenAI 新模型主打性价比
↗ 查看原文 · arstechnica.comAnthropic 和 OpenAI 相继发布新模型,均承诺以更低成本提供略强的能力,前沿模型竞争进入比价阶段。
- 21:08
CetinLM 4.50B 发布,主打小规模模型路线
↗ 查看原文 · dev.toDEV Community 出现 CetinLM 4.50B 的介绍文章,称其挑战硅谷依靠大规模算力堆叠的路线,但来源未…
- 9 月 22 日 21:0020:45
OpenAI GPT-5.6 调整指向更广的 API 性价比策略
↗ 查看原文 · dev.toOpenAI 在 GPT-5.6 上的最新改动,被视为其 API 定价与性能策略的一部分,对开发者构建应用有直接影响。
- 20:24
- 9 月 22 日 19:0018:48
llm 0.36 发布,新增 GPT-6 模型支持
↗ 查看原文 · simonwillison.netSimon Willison 发布 llm 0.36,新增 gpt-6-sol 与 gpt-6-luna 两个 Open…
- 18:15
Unreal Labs 发布 Unreal Agent,称比 Codex 省 40% 成本
↗ 查看原文 · unreallabs.aiUnreal Labs 发布 agent harness 工具 Unreal Agent,通过异步管理工具调用减少模型开…
- 9 月 22 日 18:0018:00
Hacker News 出现 GPT-6 Sol 与 Luna 讨论帖
↗ 查看原文 · openai.comHacker News 上出现标题为 GPT-6 Sol and Luna 的帖子,来源未提供更多细节。
- 17:32
TypeSafe 发布 Jev:不输出文本,只返回概率
↗ 查看原文 · dev.toTypeSafe 于 2026 年 9 月 15 日发布 Jev,称其为 System One 模型,其输出不是文本而是…
- 17:14
llm-anthropic 0.29 支持 Claude Opus 5.5
↗ 查看原文 · simonwillison.netllm-anthropic 发布 0.29 版本,新增对 Claude Opus 5.5 的支持,可通过命令行直接调用该…
- 9 月 22 日 17:0016:51
Artificial Analysis 发布 Claude Opus 5.5 评测:智能指数居首
↗ 查看原文 · artificialanalysis.aiArtificial Analysis 公布 Claude Opus 5.5 的智能、性能与价格分析,其智能指数得分 5…
- 16:30
Anthropic 发布 Claude Opus 5.5,加强网络安全防护
↗ 查看原文 · theverge.comAnthropic 推出 Claude Opus 5.5,称在近期 AI 越界事件后加强了安全防护,改进了试图逃出测试沙…
- 16:27
Anthropic 发布 Claude Opus 5.5,运行成本比 Opus 5 低 40%
↗ 查看原文 · anthropic.comClaude Opus 5.5 是 Claude 5.5 系列首个模型,多数工作上达到 Claude Fable 5.1…
- 9 月 22 日 16:0015:59
- 15:54
llm-typesafe 0.1a0 发布,为 LLM 接入 Jev 模型
↗ 查看原文 · simonwillison.netSimon Willison 发布 LLM 插件 llm-typesafe 0.1a0,用于支持 TypeSafe AI…
- 9 月 22 日 14:0013:57
- 9 月 22 日 13:0012:11
decider:单次前向传播输出类型化决策与校准概率
↗ 查看原文 · dev.to一个开放模型系列发布,针对状态回答类型化问题并给出概率分布而非文本,同时公布了 Decision Index 对其校准程…
- 9 月 22 日 12:0011:50
小米直播炼丹 6 天烧光 2000 多万,拿下开源第一
↗ 查看原文 · qbitai.com小米以直播形式进行模型训练,6 天花费 2000 多万元,最终拿下开源榜单第一,Hugging Face CEO 对此表…
- 11:22
- 9 月 22 日 11:0010:48
- 9 月 22 日 08:0007:35
- 9 月 22 日 06:0005:23
- 9 月 22 日 05:0005:00
- 9 月 22 日 04:0003:48
- 03:42
- 9 月 22 日 00:0023:09
TypeSafe AI 推出 Jev,输出概率决策而非文本
↗ 查看原文 · simonwillison.netTypeSafe AI 发布 Jev,被称为「System One 模型」的首个实例。它仍接收文本输入,但输出的是对应分…
- 9 月 21 日 23:0022:46
CetinLM 3.8B 发布,主打小规模模型路线
↗ 查看原文 · dev.to有开发者发布 3.8B 参数模型 CetinLM,文章称其挑战硅谷依赖大规模算力的路线。来源未给出具体评测数据或开源协议…
- 9 月 21 日 16:0015:41
TypeSafe AI 的 Jev 模型无法生成文本,在网页抓取中有何用
↗ 查看原文 · dev.toTypeSafe AI 的 Jev 模型无法生成字符串,因此不能直接抽取字段。文章介绍它与 LLM 的区别,以及它在网页…
- 9 月 21 日 14:0013:58
OceanBase 纯国产组合登顶国际 Data Agent 榜
↗ 查看原文 · infoq.cnInfoQ 中文报道,OceanBase 以不依赖最强大模型的纯国产技术组合,在国际 Data Agent 榜单上取得全…
- 13:16
GitHub Copilot 推出 HydraFusion 项目
↗ 查看原文 · infoq.cnGitHub Copilot 发布 HydraFusion 项目,通过多模型路由的方式来实现前沿级性能。
- 9 月 21 日 12:0012:00
Higgsfield AI 借 GPT-6 Astra 一天上线新视频功能
↗ 查看原文 · openai.comHiggsfield AI 基于 GPT-6 Astra 推出新的视频功能,让小型企业更易制作视频广告,同时加快创意工具…
- 9 月 21 日 10:0009:41
LADDER:图引导扩散语言模型加速多跳推理
↗ 查看原文 · arxiv.org研究将扩散语言模型与GraphRAG结合,提出事件驱动自时钟检索与不完整查询图传播模块,在三个多跳问答基准上平均精确匹配…
- 9 月 21 日 09:0008:45
- 08:21
- 08:11
Taramandal-GPT:面向航天动力学的领域模型
↗ 查看原文 · arxiv.org该框架基于Qwen3-8b,加入RAG流程与回退机制,在包含299道题的航天动力学基准APBench上,与主流开源及闭源…
- 9 月 21 日 08:0007:11
Kev:基于 Qwen3.5 的小型决策模型开源
↗ 查看原文 · github.com开发者 jaredpalmer 开源 Kev,一组基于 Qwen3.5 的小型决策模型,提供 0.8B、4B、9B 权重…
- 9 月 21 日 07:0006:48
孟加拉法律领域LLM蒸馏出手机端RAG模型
↗ 查看原文 · arxiv.org研究通过两阶段渐进蒸馏将90亿参数Gemma-2压缩为20亿参数学生模型,结合稠密检索与BM25检索孟加拉国3.6万余条…
- 06:22
- 9 月 21 日 05:0004:42
Mini-AGI:8GB 显存笔记本上训练的持续学习模型
↗ 查看原文 · github.com开发者开源 mini-AGI,一个字节级持续学习语言模型,在单张 8GB 显存 GPU 上从零训练,权重存为磁盘文件按需…
- 9 月 21 日 04:0003:46
- 03:28
- 9 月 21 日 03:0002:48
- 9 月 21 日 00:0000:00
Hugging Face 发布 tokenizers v1,性能提升数十倍
↗ 查看原文 · huggingface.coHugging Face 发布 tokenizers v1,重点优化性能,编码解码速度相比 v0.23 常提升数十倍。官…
- 23:19
字节 Seed 与清华 AIR 开源 RL 系统 DAPO
↗ 查看原文 · github.com字节 Seed 与清华 AIR 开源大规模 LLM 强化学习系统 DAPO,含算法、代码与数据集,基于 verl 框架…
- 9 月 20 日 21:0020:10
- 9 月 20 日 20:0019:52
国产旗舰模型单次成本仅为 Opus 5 的 1/8,跻身 AA 榜前三
↗ 查看原文 · infoq.cn一款国产旗舰模型瞄准 AI 编程、金融等场景,单次调用成本仅为 Opus 5 的八分之一,并进入 AA 榜单全球前三。
- 9 月 20 日 13:0012:22
- 9 月 20 日 12:0011:34
8 篇必读论文:Agent Harness 进展
↗ 查看原文 · dev.to过去两个月 arXiv 上出现一批关于 Agent Harness 的论文,作者来自阿里巴巴 DreamX 等团队,文章…
- 11:23