AI 快讯
LIVE · 24h全网 AI 动态的中文速报,聚合引擎每 15 分钟更新。
- 昨天 20:0020:00
GitLab CI 变更应视为图变更而非文本差异
文章指出 GitLab CI 的危险改动在合并请求中往往看似平常,YAML 差异很小,建议将每次 .gitlab-ci.yml 编辑视为图变更而非文本差异。
↗ dev.to · CI/CD - 昨天 19:0019:51
Simon Willison 发布多数据库工具 alchemy-utils 0.1a0
Simon Willison 发布 alchemy-utils 0.1a0,这是其 sqlite-utils 的数据库无关版本,基于 SQLAlchemy,支持 PostgreSQL 和 SQLite,原型由 Codex 与 GPT-5.6 Sol Ultra 协助构建。
↗ simonwillison.net · 工具 - 19:51
- 19:48
AI 偏见审计开发者指南:Saliency Maps、TCAV 与扰动测试
文章指出多数团队只在训练后检查一个聚合公平性指标,并介绍基于显著图、TCAV 和扰动测试等更深入的 AI 偏见审计方法。
↗ dev.to · AI 安全 - 19:47
- 19:20
- 19:20
- 19:14
拉取480个AGENTS.md/CLAUDE.md文件后,正则bug让我不信任自己的启发式
作者从272个仓库中收集了480份真实的 AGENTS.md 和 CLAUDE.md 文件,并构建成语料库。过程中一个正则表达式 bug 让他意识到不能轻信自己的启发式规则。
↗ dev.to · 工具 - 19:05
- 19:00
用 GitHub Copilot 应用写出你的第一个 Prompt
GitHub 官方博客介绍如何在 Copilot 应用中编写第一个提示词,包括选择正确的上下文和模型,并开始第一个任务。
↗ github.blog · 工具 - 昨天 18:0018:44
AI Agent 写迁移看似安全,实则可能破坏 Postgres
AI agent 生成的数据库迁移看似安全,实则可能对 Postgres 造成破坏。报道提到有 agent 在 Cursor 中删除了公司生产数据库及备份。
↗ dev.to · AI Agent - 18:32
Plan Measure:开源浏览器工具,测量建筑 PDF 图纸
作者开发了 Plan Measure,一个用于测量建筑 PDF 图纸的开源浏览器工具。可免费用于图纸测量场景。
↗ dev.to · 开源 - 18:27
- 18:07
- 18:02
Twitch 默认用主播内容训练 Amazon AI,可主动退出
Twitch 默认允许将自己的频道内容用于训练 Amazon 的生成式 AI 模型,除非创作者主动在设置中退出。涉及内容包含直播、VOD、剪辑、聊天及频道文字图片等。
↗ 404media.co · 隐私 - 昨天 17:0017:57
- 17:57
角色专业化模型 (RSM):协调 Agentic 软件开发中基于 LLM 的工具
论文提出角色专业化模型,通过案例研究协调 Antigravity、Gemini CLI 和 Qwen Code 三种 LLM 工具开发 Python 桌面应用,并评估角色偏差及 ISO/IEC 25010 质量,结果显示角色协调有助于项目组织,但需人工验证。
↗ arxiv.org · 论文 - 17:52
- 17:50
用RAG-LLM自动构建动态主逻辑知识图谱用于复杂系统诊断
该论文提出一个框架,利用检索增强生成和大型语言模型,从系统描述自动构建动态主逻辑模型并表示为知识图谱,应用于沸水反应堆系统验证,表明可将技术文档转化为可执行的诊断模型。
↗ arxiv.org · 论文 - 17:46
开发者在本地扫描 4,078 个 AI Agent 包并分享发现
作者在自己的机器上扫描了 4,078 个 AI Agent 包,发现 AI 编码 Agent 不只是读取配置,还包括安装的技能、MCP 服务器和规则文件等。
↗ dev.to · AI Agent - 17:35
作者在 VS Code 免费试用 Kimi K3,测试能否替代 Claude 或 GPT
作者在 VS Code 中免费试用了 Moonshot AI 的 Kimi K3,想看看它能否替代 Claude 或 GPT。
↗ dev.to · 模型评测 - 17:29
- 17:29
Twitch 主播可退出将内容用于训练 Amazon AI
Twitch 用户现在可以选择退出,让自己的直播、VOD、剪辑、聊天及频道图文不被用于训练 Amazon 的生成式 AI 模型。
↗ theverge.com · 隐私 - 17:22
- 17:19
别再所有人平分 AI 算力:顶级模型给资深工程师才省钱
讨论认为不应让所有开发人员平均分配 AI 算力,顶级模型应优先给资深工程师使用,这样更省钱,新人刷题式成长已经失效。
↗ infoq.cn · AI - 17:14
Meteor 可插拔 DDP 传输:引入 uWebSockets.js
Meteor 应用传输 DDP 消息一直基于 SockJS,已有 13 年历史,现在可换上新的 uWebSockets.js 传输实现。
↗ dev.to · 工具 - 17:13
- 17:04
- 17:04
Diagram-MMU:科学图表多模态评测基准
Diagram-MMU 是一个面向科学图表解析与理解的多模态评测基准,包含 3.7k 图表、18.3k 个人工校验问题,覆盖六个领域。评测 12 个模型发现,模型对图表推理较好,但解析和编辑成代码的能力不足。
↗ arxiv.org · 论文 - 昨天 16:0016:59
第49天:使用Kubernetes Deployments部署应用
教程内容围绕Nautilus DevOps团队学习Kubernetes应用管理,介绍如何使用Deployments部署应用。
↗ dev.to · Kubernetes - 16:56
- 16:56
- 16:53
OpenClaw 与 Hermes Agent 对决:争夺你的数字灵魂
文章对比 OpenClaw 与 Hermes Agent 两个智能体,一个想成为你的操作系统,另一个想成为你。
↗ dev.to · 智能体 - 16:48
- 16:39
- 16:38
- 16:35
- 16:33
- 16:33
- 16:29
- 16:25
使用 SGLang 部署 DeepSeek V3 模型
文章介绍了如何用 SGLang 部署 DeepSeek V3。该模型是 671B 参数的混合专家模型,采用多头潜在注意力机制。
↗ dev.to · 模型部署 - 16:22
GitHub Pull Requests 和 Issues 事件已解决
GitHub 状态页显示,与 Pull Requests 和 Issues 相关的事件已解决。
↗ githubstatus.com · 事故 - 16:17
FastAPI 在流式路由上接受 response_model 但静默忽略
FastAPI 会在流式路由上构建 response_model 并注册到 OpenAPI 文档,但实际不会应用它。开发者需注意这一行为。
↗ dev.to · 工具 - 16:17
从半途训练到可复现评估的实战分享
一篇关于 Qwen3-Omni-30B-A3B-Instruct 在巴巴多斯报纸数据上微调的记录,讲述如何将未完成的训练转化为可复现的评估流程。
↗ dev.to · 模型微调 - 16:14
OlmoEarth 开放 Embedding 导出功能
AI2 在 OlmoEarth Studio 中新增 embedding 向量导出,支持自定义区域、时间和分辨率,输出轻量 COG 文件。模型权重、代码与论文均已公开,可用于相似性检索、分割等下游任务。
↗ huggingface.co · 开源 - 16:04
DeepSeek 发布 V4 Pro 0813 正式版
DeepSeek V4 Pro 0813 为 V4 Pro 的 GA 版本,采用大规模 MoE 架构,上下文 1M,OpenRouter 定价每百万 token 输入 $0.435、输出 $0.87,于 2026 年 8 月 12 日发布。
↗ openrouter.ai · 模型发布 - 昨天 15:0015:59
xAI 发布 Grok 4.6,面向智能体构建者
xAI 于 2026 年 8 月 12 日发布 Grok 4.6,作为 7 月 Grok 4.5 的继任者,文章介绍了其基准表现、定价及对智能体开发者的意义。
↗ dev.to · 模型发布 - 15:52
D'Addario承认宣传视频使用AI音乐
吉他公司D'Addario在争议数周后承认,近期宣传视频中使用了AI音乐(Suno)。此前近两周公司一直否认,即使证据不断增加。
↗ theverge.com · AI音乐 - 15:45
- 15:45
Google Cloud托管推理:Gemini企业平台结合Cloud Run
介绍如何在Google Cloud上运行托管AI推理,将Gemini企业Agent平台与Cloud Run配对,逐步讲解架构、代码、部署和安全。
↗ dev.to · 工具