跳到正文

#开源生态

今日 0 条
8月4日周二
  1. Microsoft Research80

    微软开源 Orchard 智能体训练框架,Orchard-SWE 在 SWE-bench Verified 达 69.7%

    微软研究院开源 Orchard,一个面向可扩展智能体 AI 研究的框架,核心是 Kubernetes 环境服务 Orchard Env,支持软件工程、网页导航和个人助理三类智能体,并可直接在 Codex、OpenClaw 等真实部署 harness 中训练。

    推荐理由:原文给出了开源框架、三个训练配方和关键基准成绩,读者可据此判断小模型在真实部署环境中的训练路径是否可复用。

7月23日周四
7月15日周三
  1. Hugging Face Blog82

    Thinking Machines 发布开源多模态模型 Inkling 及 Inkling-Small

    Thinking Machines 在 Hugging Face 发布开源多模态模型 Inkling,约 1T 参数、支持 1M 上下文,原生接受图像、文本和音频输入,具备智能体能力,并提供 BF16 和 NVFP4 变体。

    推荐理由:原文给出了 Inkling 的架构细节、部署配置和基准表现,读者可以据此判断它作为开源多模态模型的定位与可用性。

7月8日周三
  1. Hugging Face Blog75

    vLLM transformers 建模后端提速至原生速度

    Hugging Face 宣布 vLLM 的 transformers 建模后端现已达到或超过手写原生实现的推理速度,在 Qwen3-4B、32B 和 235B MoE 三种模型上均验证通过。模型作者无需移植代码,只需在 vLLM 中加 --model-impl transformers 参数即可获得原生级推理性能,且该后端通过 torch.fx 和 AST 在运行时自动应用层融合优化。

    推荐理由:原文给出实测对比和启用方式,读者可据此判断是否值得升级 vLLM 并切换后端。

7月7日周二
  1. Hugging Face Blog78

    LeRobot v0.6.0 发布:引入世界模型、新 VLA 与统一评测基准

    LeRobot v0.6.0 正式发布,旨在闭环机器人学习流程。新版本引入三种世界模型策略(VLA-JEPA、LingBot-VA、FastWAM),新增多个 VLA(GR00T N1.7、MolmoAct2、EO-1、EVO1、Multitask DiT),并推出统一的奖励模型 API(Robometer、TOPReward)。

    推荐理由:官方发布 LeRobot v0.6.0,涵盖世界模型、新 VLA、奖励模型、评测基准与部署 CLI,可帮助读者了解开源机器人学习框架的最新能力。

  2. Hugging Face Blog78

    SkyPilot 与 Hugging Face 联合推出零出口流量存储,跨云训练直接挂载 Hub 数据

    SkyPilot 与 Hugging Face 联合推出 store: hf 后端,用一条 hf:// URL 和现有 HF_TOKEN 即可把 Hugging Face Bucket 或任意 Hub 仓库挂载进 SkyPilot 任务,在 20+ 云、Kubernetes、Slurm 和本地集群上运行。

    推荐理由:原文给出了 hf:// 挂载、零出口流量和 Xet 去重的具体机制与实测数字,读者可据此判断跨云训练的数据成本能省多少。

7月6日周一
  1. Hugging Face Blog62

    Hugging Face 重构 Kernels 项目:新增内核仓库类型、代码签名与智能体开发支持

    Hugging Face 发布 Kernels 项目重大更新,在 Hub 上引入新的 kernel 仓库类型,并默认只加载受信任发布者的内核,同时加入基于 Sigstore cosign 的代码签名机制。

    推荐理由:原文梳理了内核仓库类型、签名验证和 CLI 重构等关键变化,读者可据此判断新内核工作流的安全边界与适配范围。

7月2日周四
  1. Mistral AI82

    Mistral 发布 Leanstral 1.5,6B 激活参数开源模型在形式化验证上刷新多项基准

    Mistral 发布 Leanstral 1.5,一款 Apache-2.0 许可、总参数 119B 但仅 6B 激活的开源模型,在 miniF2F 上达到 100%,解决 PutnamBench 587/672 题,并在 FATE-H(87%)和 FATE-X(34%)上取得新 SOTA。

    推荐理由:原文给出了基准成绩、成本对比和真实代码库找 bug 的案例,读者可据此判断它在形式化验证上的实用程度。

7月1日周三
  1. Hugging Face Blog60

    Hugging Face 与 Cerebras 联手推出实时语音 AI 演示

    Hugging Face 与 Cerebras 合作推出实时语音 AI 演示,构建了全开源的级联式语音到语音流水线:语音输入经 Nvidia Parakeet 识别,由 Cerebras 上的 Gemma 4 31B 处理,再经阿里 Qwen3TTS 合成语音输出。该流水线已驱动超过 9,000 台 Reachy Mini 机器人,旨在通过低延迟和稳定推理改善对话的自然感。

    推荐理由:原文展示了开源语音流水线与 Cerebras 推理速度结合后的实时对话体验,读者可据此评估端到端语音方案的延迟表现。

6月30日周二
6月11日周四
  1. Google DeepMind79

    Google DeepMind 发布开源扩散模型 DiffusionGemma,推理速度最高提升 4 倍

    Google DeepMind 发布实验性开源模型 DiffusionGemma,采用文本扩散技术并行生成整块文本,在专用 GPU 上推理速度最高提升 4 倍,单张 NVIDIA H100 上每秒可生成 1000+ token。该 26B MoE 模型推理时仅激活 3.8B 参数,量化后适配 18GB 显存,面向内联编辑、代码填充等速度敏感的本地交互场景,但整体输出质量低于标准 Gemma 4。

    推荐理由:原文给出了速度提升、硬件门槛和适用场景,读者可据此判断它适合哪些本地交互工作流。

6月9日周二
6月4日周四
  1. Google Research78

    Google 开源水文建模框架,助力 AI 洪水预报落地

    Google Research 在 GitHub 上以 Apache 2.0 协议开源其水文建模框架,该框架基于 PyTorch 和 LSTM 架构,使用 Caravan 数据集训练,可复现 Google Flood Hub 的河流洪水预报能力。新版模型在基准测试中比旧版将可靠预测期延长六天(有水文站流域)和一天(无水文站流域),并已与捷克水文气象研究所合作集成到 Delft-FEWS 平台。

    推荐理由:原文给出了模型架构、训练数据和基准提升,读者可据此评估将 AI 洪水预报接入本地工作流的可行性。

5月29日周五
  1. Google Research62

    Google Research 在 I/O 2026 发布 Gemini for Science 与 Antigravity 2.0 等多项成果

    Google Research 在 I/O 2026 上发布多项成果,包括面向科学研究的 Gemini for Science 工具套件(含 Computational Discovery、Hypothesis Generation 等)、升级的智能体开发平台 Antigravity 2.0,以及基于 Coral NPU 的 Synaptics Coralboard 开发板。

    推荐理由:原文汇总了 Gemini for Science、Antigravity 2.0、Coralboard 等多项发布,读者可借此把握 Google 在科学研究和开发者工具上的整体布局。

5月28日周四
  1. Mistral AI62

    Mistral 发布工业工程 AI 栈并升级 Vibe 智能体

    Mistral 在 AI Now Summit 2026 上发布面向工业工程的集成 AI 栈,与 Airbus、BMW、ASML 合作优化设计、仿真与生产,并强调数据安全。其智能体工具 Vibe 升级为可处理编码、研究等长周期任务的统一智能体,同时宣布在法国 Les Ulis 建设 10 MW 推理数据中心,计划 2026 年 Q3 启用。

    推荐理由:原文给出工业工程 AI 栈、Vibe 智能体升级和法国数据中心三项动作,读者可据此了解 Mistral 面向企业关键流程的布局。

5月22日周五
  1. Mistral AI80

    Mistral 发布 Mistral Medium 3.5,并推出云端远程编码智能体

    Mistral 发布旗舰模型 Mistral Medium 3.5,这是一个 128B 稠密模型,拥有 256k 上下文窗口,采用修改版 MIT 许可开放权重,可在最少四张 GPU 上自托管,SWE-Bench Verified 得分 77.6%。

    推荐理由:原文给出了新模型的规模、价格和开放权重,读者可以据此判断它是否适合自托管或接入现有编码工作流。

5月2日周六
4月3日周五
3月24日周二
  1. Mistral AI77

    Mistral AI 发布 Voxtral TTS 语音合成模型

    Mistral AI 发布 Voxtral TTS,这是其首个文本转语音模型,4B 参数,支持 9 种语言,具备情感表达、低延迟和零样本跨语言声音适配。模型基于 Ministral 3B,采用 Transformer 自回归流匹配架构,模型延迟 70ms,实时因子约 9.7x。

    推荐理由:原文给出了模型架构、定价和与 ElevenLabs 的人工评测对比,读者可据此判断其在语音智能体场景的适用性。

3月17日周二
3月7日周六
  1. Google Research62

    Google Research 发布 WAXAL 非洲语言语音数据集,覆盖 27 种语言

    Google Research 发布 WAXAL,一个开放获取的非洲语言语音数据集,初始覆盖 27 种撒哈拉以南非洲语言,包含约 1,846 小时 ASR 转写语音和超过 565 小时 TTS 高保真录音,采用 CC-BY-4.0 许可。数据由非洲学术和社区组织主导收集,旨在赋能区域 AI 生态,构建更贴合当地语言多样性的语音系统。

    推荐理由:原文给出了数据规模、许可方式和合作模式,读者可以据此判断它如何缓解非洲语言语音数据稀缺问题。

2月5日周四
12月9日周二
  1. Mistral AI82

    Mistral AI 发布 Devstral 2 编码模型与 Mistral Vibe CLI

    Mistral AI 发布下一代编码模型 Devstral 2(123B)和 Devstral Small 2(24B),均采用宽松开源许可,Devstral 2 在 SWE-bench Verified 上取得 72.2% 的成绩,并推出原生 CLI 工具 Mistral Vibe 实现端到端代码自动化。

    推荐理由:原文给出了新模型在 SWE-bench Verified 上的得分、与闭源模型的差距以及 API 定价,读者可据此判断开源编码模型的实际水平与成本。

12月3日周三
11月19日周三
  1. Mistral AI38

    Mistral AI 宣布与 SAP、Helsing 合作,扩大德国布局以推动欧洲 AI 主权

    Mistral AI 宣布与 SAP 建立多年合作,为德国和欧洲提供完全主权的 AI 技术栈,将其模型集成至 SAP 的 AI Foundation,并共同开发面向复杂行业与行政机构的解决方案。同时与 Helsing 合作加速视觉-语言-动作模型在国防与安全领域的开发。公司还计划未来数月内在德国开设办公室并大幅扩充本地团队。

9月9日周二
7月30日周三
  1. Mistral AI62

    Mistral 发布 Codestral 25.08 及完整企业编码栈

    Mistral 发布 Codestral 25.08,接受补全提升 30%、保留代码增加 10%、失控生成减少 50%,并推出包含 Devstral、Codestral Embed 和 Mistral Code 插件的完整企业编码栈,支持云端、VPC 或本地部署。Capgemini、Abanca、SNCF 等企业已在生产环境使用该方案。

    推荐理由:原文给出了 Codestral 25.08 的量化提升和完整企业级编码栈的部署方式,读者可据此评估自托管方案的价值。

7月15日周二
  1. Mistral AI78

    Mistral 发布开源语音理解模型 Voxtral,提供 24B 与 3B 两个版本

    Mistral AI 发布开源语音理解模型 Voxtral,提供 24B 生产级和 3B 端侧两个版本,均采用 Apache 2.0 许可并开放 API。Voxtral 支持 32k token 上下文、最长 30 分钟转写或 40 分钟理解、内置问答与摘要、多语言识别及语音直接触发函数调用。

    推荐理由:原文给出了两个开源语音模型的规模、许可和定价,读者可据此评估其在生产场景中的成本与部署选择。

7月11日周五
6月11日周三
6月10日周二
6月4日周三
  1. Mistral AI67

    Mistral 发布企业级 AI 编程助手 Mistral Code

    Mistral 发布企业级 AI 编程助手 Mistral Code,整合 Codestral、Devstral 等四款模型与 IDE 插件、本地部署和企业工具,支持微调与私有化部署。产品基于开源项目 Continue 构建,今日开放 JetBrains 和 VSCode 的私有测试,已获 Abanca、SNCF 和 Capgemini 等企业采用。

    推荐理由:原文给出了产品定位、部署方式和客户案例,读者可以据此判断企业级 AI 编程助手市场的竞争格局。

5月21日周三
  1. Mistral AI75

    Mistral AI 发布开源编码智能体 Devstral

    Mistral AI 与 All Hands AI 合作推出面向软件工程任务的智能体大模型 Devstral,在 SWE-Bench Verified 上取得 46.8% 的成绩,超过此前开源最优模型 6 个百分点以上,并以 Apache 2.0 协议免费开源。

    推荐理由:原文给出了基准成绩、开源许可和本地部署门槛,读者可据此评估它作为开源编码智能体的实际可用性。

5月7日周三
  1. Mistral AI74

    Mistral AI 发布 Mistral Medium 3,主打低成本高性能

    Mistral AI 发布 Mistral Medium 3,在多数基准上达到 Claude Sonnet 3.7 的 90% 以上性能,定价为每百万 token 输入 $0.4、输出 $2,成本显著更低。该模型在编码和 STEM 任务上接近更大规模的竞品,并支持混合部署或本地 VPC 部署,API 即日起在 Mistral La Plateforme 和 Amazon Sagemaker 上线。

    推荐理由:原文给出了性能对比和定价,读者可以据此判断中等规模模型在成本与能力之间的取舍。

3月17日周一
  1. Mistral AI72

    Mistral Small 3.1 发布:128k 上下文、多模态、Apache 2.0 开源

    Mistral AI 发布 Mistral Small 3.1,在文本性能、多模态理解和 128k 上下文窗口上较前代升级,推理速度达每秒 150 tokens,性能超越 Gemma 3 和 GPT-4o Mini,并以 Apache 2.0 许可开源。

    推荐理由:官方公布了性能对比、推理速度和开源许可,读者可据此判断它相对同类小模型的定位与适用场景。