跳到正文

#开源生态

今日 1 条
今天9月29日周二
  1. The Verge · AI40

    Engram 采样器:将 AI 幻觉变成音乐

    音乐初创公司 Thoughtful Things 为旗下首款乐器 Engram 发起 Kickstarter 众筹。这是一款采样器与律动工作站,利用本地运行的“微型 AI”处理输入音频,甚至能幻觉出全新声音,旨在探索实验性音色而非生成流行歌曲。其模型基于仅含商用授权音频的开放数据集自研训练,公司计划开源固件,众筹限量版起价 $675。

9月28日周一
  1. Mistral AI38

    Mistral 在慕尼黑开设德国中心,推进欧洲工业 AI

    Mistral 在慕尼黑开设新中心,聚焦 Physics AI 与工业 AI,并直接服务企业合作伙伴。该中心将组建 Physics AI 和工业 AI 专项研究团队,并与宝马、西门子能源及慕尼黑工业大学合作。Mistral 计划到 2030 年建成 1 吉瓦欧洲算力,其开放权重架构支持模型在客户自有基础设施上运行,数据不离开组织。

  2. Simon Willison77

    Simon Willison 年度演讲:2026年AI行业全景回顾

    Simon Willison 在 WeAreDevelopers 大会闭幕演讲中回顾了2026年AI行业的关键趋势。年初 Claude Opus 4.5 和 GPT-5.1 让编码智能体变得可靠,随后 OpenClaw 掀起个人智能体热潮,开源模型如 Qwen 3.8 27B 已能在笔记本上接近前沿水平。

    推荐理由:作者以亲历者视角梳理2026年AI行业关键趋势,从编码智能体成熟到开源模型崛起,适合快速把握一年脉络。

  3. Simon Willison40

    Bluesky 回复机器人检测工具

    针对 Bluesky 上日益增多的自动回复机器人,Simon Willison 用 Opus 5.5 通过 vibe coding 开发了一款检测工具。该工具通过分析账户回复速度、是否从不发布原创内容以及回复中是否含问号等信号,识别疑似回复机器人。Bluesky 仍提供免费可用的 API,使这类调查成为可能。

9月25日周五
9月24日周四
  1. Hugging Face Blog60

    Liquid AI 发布 LFM2.5-VL-DSpark 草稿模型,加速视觉语言模型推理

    Liquid AI 发布 LFM2.5-VL-3B 的实验性 DSpark 草稿模型,通过投机解码在几乎不增加内存的前提下提升推理速度,解码加速最高达 3.13x(设备端)和 2.66x(H100),端到端提升最高 2.62x 和 2.27x。

    推荐理由:原文给出了解码加速倍数、内存开销和三种推理框架的接入方式,读者可据此评估端侧视觉模型的推理收益。

  2. NVIDIA Blog75

    NVIDIA 联合 Google DeepMind 等机构发布 2800 多种病毒蛋白复合物 3D 结构开放数据集

    NVIDIA 联合 Google DeepMind、EMBL-EBI 等机构,通过 AlphaFold Database 开放了 2800 多种病毒的蛋白复合物预测 3D 结构,供全球任何科学家使用。

    推荐理由:原文给出了数据集规模、开放入口和可复用的推理流程,读者可据此评估它对病毒研究和疫情准备的实际价值。

  3. Latent Space78

    Meta Connect 2026 发布 Muse 智能体、VR 眼镜与 Charm,前沿模型仅预告未发布

    Meta 在 Connect 2026 上以个人智能体 Muse 为核心,推出语音与实时视频、Mac 电脑使用、Muse Mail 及 1500+ 连接器,并发布 Ray-Ban Meta Gen 3、售价 1299 美元的 Meta VR Glasses 和 12 月发货的 Muse Charm。

    推荐理由:Meta Connect 2026 的完整梳理,涵盖硬件、智能体、语音与收购,可作了解 Meta 全栈布局的入口。

  4. Hugging Face Blog62

    NVIDIA 教程:用 Warp 与 MJWarp 将 MuJoCo 机器人仿真扩展到 2048 并行环境

    NVIDIA 发布教程,讲解如何用 NVIDIA Warp 与 MuJoCo Warp(MJWarp)将 SO-101 机械臂场景从单世界 CPU 仿真迁移到最多 2048 个并行 GPU 环境。文章覆盖单世界校验、批量分配、容量调优与吞吐测量,并给出 pip install warp-lang 与 mujoco-warp 的安装入口。

    推荐理由:原文给出从单世界 MuJoCo 迁移到 2048 并行 MJWarp 环境的完整步骤,读者可直接照做并复现吞吐测量。

9月23日周三
9月22日周二
  1. NVIDIA Blog62

    NVIDIA Isaac ROS 5.0 发布,引入智能体工作流并支持 ROS Lyrical

    NVIDIA 在 ROSCon 大会上发布 Isaac ROS 5.0,这是一套基于 ROS 的 GPU 加速开源包,新增智能体工作流和平台支持,帮助开发者更快构建、定制和部署机器人应用。

    推荐理由:原文给出了 Isaac ROS 5.0 的智能体工作流、ROS Lyrical 支持和生态伙伴落地案例,读者可据此判断它如何加速机器人开发。

  2. Hugging Face Blog42

    oMLX 创建者 Jun Kim 加入 Hugging Face,助力 MLX 社区发展

    oMLX 创建者及维护者 Jun Kim 加入 Hugging Face,以支持 MLX 社区。oMLX 将保持 Apache 2.0 开源协议,并由 Jun 继续主导开发,从兼职项目升级为全职维护项目,有望带来更稳定的发展和更快的迭代。Hugging Face 希望 oMLX 成为新想法的试验场,并加速 transformers 模型定义到 MLX 实现的转换。

  3. Hugging Face Blog73

    Hugging Face transformers 支持运行 llama.cpp 的 GGUF 量化模型

    Hugging Face 在 transformers 中加入对 GGUF 模型的高效运行支持,通过复用 ggml 的 Metal 内核,可在 Apple Silicon 上以熟悉的 from_pretrained 接口加载并生成。

    推荐理由:原文给出了 GGUF 加载方式、性能对比和当前限制,读者可以据此判断在 transformers 里跑本地量化模型的可行性与适用场景。

  4. NVIDIA Blog33

    从赋能到落地,埃及AI生态迈向生产规模

    埃及AI生态正从潜力走向规模化生产,NVIDIA在开罗举办活动展示其全栈AI方案。过去一年,NVIDIA深度学习学院在埃及的学习者数量增长超十倍;Hassan Allam Data Centers获许可建设数据中心,预计投资4亿美元。非洲一年内新增四座AI工厂,另有656兆瓦容量在建,Cassava Technologies等企业正推动本地化AI基础设施部署。

9月21日周一
  1. NVIDIA Blog42

    AI 安全是工程问题:NVIDIA 如何在智能体栈每一层解决它

    NVIDIA 提出 AI 安全本质是工程问题,需在智能体栈的每一层(模型、工具、运行时环境)落实可执行的安全边界、责任人与防护证据。NVIDIA 开源 OpenShell 安全运行时,在智能体触及范围之外强制策略并提供沙箱执行;Cisco DefenseClaw、JFrog 等合作伙伴正基于 OpenShell 构建治理与技能扫描层。

  2. Hugging Face Blog62

    Multiverse 提出将 LLM 块剪枝转化为伊辛优化问题,深度压缩下 MMLU 提升近 23 个百分点

    Multiverse Computing 发表论文,将大语言模型的块删除(深度剪枝)重构为约束二元优化问题,映射到伊辛玻璃自旋系统,用能量作为下游性能的廉价代理,从而无需逐一基准测试即可筛选大量候选配置。

    推荐理由:把剪枝块选择映射为伊辛玻璃能量最小化,用物理求解器处理组合问题,在深度压缩下显著领先现有方法。

9月17日周四
  1. GitHub Blog · AI & ML85

    GitHub 用 Copilot 将 Copilot 运行时重写为 Rust

    GitHub 用 Copilot 将 Copilot 运行时从 TypeScript 重写为超过 80 万行生产 Rust,历时约 14.5 周,由一名开发者主导完成。重写采用组件级就地替换策略,性能提升数个数量级,并新增 C ABI 支持进程内嵌入。

    推荐理由:原文给出了用 Copilot 自身完成大规模 Rust 重写的完整过程与数据,读者可据此评估 AI 辅助重写的可行性与工程方法。

9月16日周三
  1. Mistral AI60

    Mistral 与 Mozilla 合作,为 Firefox 智能窗口提供模型支持

    Mistral 宣布与 Mozilla 合作,为 Firefox 的 AI 浏览助手 Smart Window(测试版)提供模型支持,初期覆盖法国和北美用户,英国和德国预计今年晚些时候跟进。双方强调开源、隐私与用户控制,对话默认不保存在 Mozilla 服务器,合作伙伴同意零数据留存。

    推荐理由:原文给出了合作范围、地区上线顺序和隐私默认设置,读者可据此判断开源模型进入浏览器助手后的实际形态。

9月10日周四
  1. Hugging Face Blog65

    Gradio Workflow 用 73 个节点重建 AUTOMATIC1111 功能集

    Hugging Face 发布 Workflow1111,用 Gradio Workflow 以 73 个节点、11 条媒体管线重建了 AUTOMATIC1111 的 stable-diffusion-webui 主要功能,涵盖文生图、图生图、高清修复、提示词矩阵、VLM 反推提示词、检测转蒙版、ControlNet 风格标注器、背景移除、PNG Info 和图生视频。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

  2. Hugging Face Blog78

    AsyncGRPOTrainer 结合 LoRA 跨 HF Jobs 训练:用存储桶同步适配器,无需 NCCL

    Hugging Face 博客介绍如何用 AsyncGRPOTrainer 结合 LoRA 在 HF Jobs 上跨节点训练,通过 Storage Bucket 同步适配器而非 NCCL,并用代理路由请求。500 步训练从 3 小时 27 分钟优化到 53 分钟,速度提升 3.9 倍,代码已开源。

    推荐理由:原文给出了完整的架构、代码和调优过程,读者可以据此复现跨节点 LoRA 异步强化学习训练。

9月8日周二
  1. Mistral AI62

    Mistral 完成 30 亿欧元 D 轮融资,估值超 210 亿欧元

    Mistral 宣布完成 30 亿欧元 D 轮融资,投后估值超 210 亿欧元,为欧洲科技公司史上最大股权融资。三星电子领投,EQT 管理的 Scaleup Europe Fund 和现有投资者 PSG Equity 联合领投。资金将用于扩大前沿研究、算力、基础设施及国际业务,公司现覆盖 20 国,服务 Airbus、ASML、HSBC 等 125 余家企业的关键 AI 转型。

    推荐理由:原文给出了融资规模、估值和领投方,读者可以据此判断欧洲AI公司的资本格局与主权AI路线的市场认可度。

9月3日周四
  1. Hugging Face Blog62

    Hugging Face 发布多模态编码器 NeoMME,260M 与 800M 两档开源

    Hugging Face 发布 NeoMME,一个 260M 和 800M 的多语言多模态编码器家族,用单一双向 Transformer 同时处理文本 token 和原始图像块,从零训练,不使用预训练视觉塔或因果语言模型。

    推荐理由:原文给出了模型架构、检索性能和压缩方案,读者可据此评估其在视觉文档检索中的适用性。

  2. Hugging Face Blog62

    用100步GRPO微调350M模型,IFStruct结构化输出从22.6%提升至29.7%

    Hugging Face 发布公开教程,用 TRL 库对 LFM2.5-350M 做约500样本、100步的 GRPO 微调,在 IFStruct 基准上从22.6%提升至29.7%,其中 JSON 通过率从18.0%升至31.9%。整套流程可在免费版 Colab 或 Kaggle GPU 上运行,评估可在 MacBook 上通过 llama.cpp 完成,代码已开源在 GitHub。

    推荐理由:给出了一套约500样本、100步的轻量GRPO微调配方,读者可据此低成本提升小模型的结构化输出合规率。

  3. Hugging Face Blog62

    用 TRL 和 OpenEnv 训练编码模型画水彩:完整开源复现

    作者用 TRL 和 OpenEnv 复现了 Surya Narreddi 的用语言模型写 JavaScript 画水彩的项目,并开源了参考数据集、RL 环境、训练脚本和训练好的模型。

    推荐理由:作者用 TRL 和 OpenEnv 完整复现了用代码画水彩的 RL 训练流程,并开源全部数据集、环境和模型,读者可据此复现或改造。

9月2日周三
  1. Google Research62

    Google 与 NASA JPL 发布 MAPL-EMIT:用深度学习从太空绘制全球甲烷排放

    Google Research 与 NASA JPL 合作发表 PNAS 论文,提出 MAPL-EMIT 深度学习框架,基于 Swin-S vision transformer 处理 EMIT 高光谱数据,可同时完成甲烷羽流增强量化、羽流分割和源定位。

    推荐理由:原文给出了模型架构、训练方法和实测召回率,读者可据此评估这套深度学习方案在甲烷点源监测上的实际能力。

9月1日周二
  1. Google Research65

    Google 发布 TimesFM-3 多变量时序预测基础模型

    Google Research 发布 TimesFM-3,这是其时序基础模型家族的新一代版本,原生预训练用于多变量预测,参数量 3.3 亿,在超过 1 万亿时间点的真实与合成语料上完成预训练。

    推荐理由:原文给出了模型架构、参数量、评测排名和开放入口,读者可据此判断它相对单变量模型的提升幅度。

  2. Microsoft Research62

    微软发布 GigaPath-Flash 与 GigaTIME-Flash 高效病理基础模型

    微软研究院发布 GigaPath-Flash 与 GigaTIME-Flash,通过知识蒸馏将十亿参数编码器压缩为 22M 参数的 ViT-S 骨干,在保持约 97% 预测性能的同时将全切片分析计算量降低约 50 倍,空间蛋白组学预测提速约 6 倍、显存减少约 8 倍。两模型均以 Apache 2.0 协议开放权重,代码与权重已上架 Hugging Face,面向科研用途而非临床诊疗。

    推荐理由:原文给出了蒸馏压缩后的效率提升和开放权重入口,读者可据此评估病理基础模型在更大队列研究中的实用成本。

8月25日周二
  1. Mistral AI40

    Mistral 与 HUMAIN 达成战略合作,推动沙特及中东主权 AI 发展

    Mistral 宣布与 HUMAIN 达成战略合作,聚焦 AI 基础设施、先进模型开发及解决方案部署,初期重点涵盖网络安全和语音领域,并计划开发在阿拉伯语上表现优异的前沿模型。双方合作金额达数亿欧元,Mistral 将探索使用 HUMAIN 的数据中心基础设施,并联合制定面向沙特受监管行业的市场策略,以满足主权 AI 需求。

8月21日周五
  1. Microsoft Research62

    微软研究院发布 Skala 1.1,扩展 DFT 精度与软件集成

    微软研究院发布深度学习 DFT 泛函 Skala 1.1,训练数据量为此前版本的 2.5 倍,在 GMTKN55 基准的 55 个类别中 32 项排名第一,加权平均误差为 2.8 kcal/mol,精度超越主流全局杂化泛函。Skala 现已集成至 CP2K,并正在集成到 Psi4、FHI-aims、ORCA 和 VASP,同时推出持续更新的性能基准报告。

    推荐理由:微软研究院发布 Skala 1.1,训练数据扩充 2.5 倍,并推进多款量子化学软件的集成,读者可据此评估其精度与可用性。

8月11日周二
  1. Mistral AI62

    Mistral 推出区域推理端点与优先级层级,并接入第三方开源模型

    Mistral 宣布三项推进 AI 主权的新举措:区域推理端点 Mistral Regional Endpoints 正式可用,允许客户选择推理在欧洲或美国运行;Mistral Priority Tier 进入公开预览,为关键任务负载提供承诺服务级别和可用性 SLA。

    推荐理由:原文给出区域端点、优先级层级和第三方开源模型接入的具体安排,读者可据此评估欧洲主权 AI 基础设施的落地路径。

8月4日周二
  1. Microsoft Research80

    微软开源 Orchard 智能体训练框架,Orchard-SWE 在 SWE-bench Verified 达 69.7%

    微软研究院开源 Orchard,一个面向可扩展智能体 AI 研究的框架,核心是 Kubernetes 环境服务 Orchard Env,支持软件工程、网页导航和个人助理三类智能体,并可直接在 Codex、OpenClaw 等真实部署 harness 中训练。

    推荐理由:原文给出了开源框架、三个训练配方和关键基准成绩,读者可据此判断小模型在真实部署环境中的训练路径是否可复用。

7月1日周三