跳到正文

全部动态

今日 48 条
1月28日周三
  1. Mistral AI65

    Mistral 发布终端原生编码智能体 Vibe 2.0,支持自定义子智能体与技能

    Mistral 发布终端原生编码智能体 Mistral Vibe 2.0,由 Devstral 2 模型驱动,新增自定义子智能体、多选澄清、斜杠命令技能和统一智能体模式。Vibe 现已在 Le Chat Pro 和 Team 套餐上线,支持按量付费或自带 API key;Devstral 2 转为付费 API 访问,Experiment 套餐仍提供免费额度。

    推荐理由:官方介绍了终端原生编码智能体的新能力和定价变化,读者可据此判断是否迁移或升级使用。

1月22日周四
  1. Mistral AI62

    Mistral AI 复盘 vLLM 内存泄漏排查:从 Heaptrack 到 GDB 定位 UCX 根因

    Mistral AI 发布工程深度复盘,记录其在 vLLM 预填充/解码分离部署中排查内存泄漏的过程。问题表现为生产流量下系统内存以每分钟 400 MB 线性增长,最终通过 pmap、BPFtrace 和 GDB 定位到 UCX 的 mmap 钩子机制导致匿名内存区域持续增长。设置 UCX_MEM_MMAP_HOOK_MODE=none 即可解决,相关修复已合并进 vLLM 仓库。

    推荐理由:Mistral AI 完整复盘了 vLLM 内存泄漏的排查链路,从 Heaptrack 到 BPFtrace 再到 GDB,读者可复用这套方法论定位依赖层隐藏问题。

1月12日周一
  1. GitHub · Portkey Gateway13

    Portkey Gateway v1.15.2 发布

    Portkey Gateway v1.15.2 发布,主要更新包括:支持 Azure Blob 批量处理、允许自定义范围与 Azure Agents 配合使用、统一 Anthropic beta 头使用,并修复了顺序 guardrails 仅执行已启用检查的行为问题。此外,更新了 README 并升级了 Vercel Cookbook 包版本。

1月10日周六
  1. Berkeley AI Research40

    信息驱动式成像系统设计:直接评估与优化成像信息含量

    伯克利AI研究团队提出一种直接基于信息含量评估与优化成像系统的框架,无需训练重建或分类网络。该方法利用成像系统已知的噪声物理特性,仅从含噪测量中估计互信息,并在彩色摄影、射电天文、无透镜成像和显微镜四个领域验证了其预测性能。优化该信息指标可达到与端到端方法相当的设计效果,同时减少内存与计算需求,且无需任务特定的解码器设计。

1月7日周三
  1. 巨潮公告 · AI算力18

    超颖电子:AI 算力高阶印制电路板扩产项目投资额上调至 33.15 亿元

    超颖电子公告变更 AI 算力高阶印制电路板扩产项目,投资金额由 146,779.75 万元调整为 331,531.84 万元人民币或等值外币。项目达产年产能由年产 11.74 万平方米提升至 16.65 万平方米,建设期限由 12 个月延长至 24 个月。变更旨在应对潜在客户更强劲的高端 PCB 产品需求及材料升级需要。

12月25日周四
  1. 巨潮公告 · 算力集群10

    森远股份与关联方中科信控签订算力集群集成建设合同,总价2678.39万元

    森远股份于2025年12月25日与控股股东中科信控签署《算力集群集成建设合同》,合同总价款26,783,852元,用于中科(济南)超级云计算中心GPU高性能计算集群及配套设施采购。该交易构成关联交易,已获董事会审议通过,关联董事回避表决。合同分两阶段交付验收,付款分四期,含30%预付款及5%三年后支付的质保金。

12月24日周三
12月23日周二
12月17日周三
  1. Mistral AI62

    Mistral 发布 OCR 3,文档解析性能大幅提升

    Mistral 发布 OCR 3,在表单、扫描件、复杂表格和手写内容上对 OCR 2 取得 74% 综合胜率,支持输出带 HTML 表格结构的 markdown。定价为每 1000 页 2 美元,Batch API 五折后降至 1 美元,模型 mistral-ocr-2512 已通过 API 和 Mistral AI Studio 的 Document AI Playground 开放使用。

    推荐理由:原文给出了 OCR 3 相对上一代的性能提升、定价与开放入口,读者可据此评估其在文档解析管线中的适用性。

12月9日周二
  1. Mistral AI82

    Mistral AI 发布 Devstral 2 编码模型与 Mistral Vibe CLI

    Mistral AI 发布下一代编码模型 Devstral 2(123B)和 Devstral Small 2(24B),均采用宽松开源许可,Devstral 2 在 SWE-bench Verified 上取得 72.2% 的成绩,并推出原生 CLI 工具 Mistral Vibe 实现端到端代码自动化。

    推荐理由:原文给出了新模型在 SWE-bench Verified 上的得分、与闭源模型的差距以及 API 定价,读者可据此判断开源编码模型的实际水平与成本。

12月3日周三
11月19日周三
  1. Mistral AI38

    Mistral AI 宣布与 SAP、Helsing 合作,扩大德国布局以推动欧洲 AI 主权

    Mistral AI 宣布与 SAP 建立多年合作,为德国和欧洲提供完全主权的 AI 技术栈,将其模型集成至 SAP 的 AI Foundation,并共同开发面向复杂行业与行政机构的解决方案。同时与 Helsing 合作加速视觉-语言-动作模型在国防与安全领域的开发。公司还计划未来数月内在德国开设办公室并大幅扩充本地团队。

11月13日周四
  1. 巨潮公告 · 多模态18

    开创电气拟与清华大学共建多模态具身智能联合研究中心并对外担保

    开创电气董事会审议通过,拟与控股子公司燕谷智能、清华大学交叉信息研究院签署协议,联合建立多模态具身智能联合研究中心,并为燕谷智能在该协议项下全部义务提供不可撤销的连带责任保证。燕谷智能五年累计向中心提供经费5000万元人民币,其中运行费500万元。该协议尚未签署,存在不确定性。

11月11日周二
  1. 巨潮公告 · AI算力15

    超颖电子拟投资14.68亿元在泰国建设AI算力高阶印制电路板扩产项目

    超颖电子全资子公司泰国超颖拟在泰国巴真府304工业园建设AI算力高阶印制电路板扩产项目,预计总投资146,779.75万元人民币,资金来源于自有或自筹资金。项目将扩大高端多层、高阶PCB产品生产规模,建设期限12个月,目前尚处前期筹备阶段,需办理相关前置审批。

11月1日周六
  1. Berkeley AI Research62

    Transitive RL:基于分治范式的强化学习算法

    Seohong Park 在 Berkeley AI Research 博客介绍了一种基于分治范式的新型强化学习算法 Transitive RL(TRL),它不依赖时序差分(TD)学习,而是通过递归拆分轨迹来减少 Bellman 递归次数,从而更好地扩展到长程任务。

    推荐理由:原文提出一种不依赖时序差分学习的强化学习新范式,并给出在长程任务上的实验结果,读者可据此评估其可行性。

10月24日周五
  1. Mistral AI60

    Mistral AI 发布 AI Studio 企业生产平台

    Mistral AI 发布 AI Studio,面向企业团队提供从原型到生产的 AI 平台,核心由可观测性、Agent Runtime 和 AI Registry 三根支柱构成。平台支持混合云、专有和自托管部署,内置评估、反馈闭环、版本追踪与治理能力,现已开放私有测试报名。

    推荐理由:原文把企业 AI 从原型到生产的瓶颈拆成可观测、可执行、可治理三根支柱,读者可据此对照自身团队的落地缺口。

9月9日周二
9月2日周二
  1. Mistral AI50

    Le Chat 推出 Memories(测试版):让 AI 记忆透明、可控、可迁移

    Mistral AI 在 Le Chat 中推出 Memories(测试版)功能,采用混合方式自动保存有用信息,但召回设计强调智能、及时且可见,始终显示所用记忆并附来源链接。用户可随时关闭记忆、使用不调用记忆的隐身聊天、编辑或删除单条记忆,并支持导出和导入,记忆可移植且可互操作。Le Chat 还引入 Memory Insights 轻量提示,帮助用户探索记忆内容并基于自身数据提供趋势和建议。

  2. Mistral AI62

    Mistral 发布 Le Chat 自定义 MCP 连接器与记忆功能

    Mistral 为 Le Chat 推出 20 多个安全 MCP 连接器(测试版),覆盖数据、生产力、开发、自动化、商务等类别,支持 Databricks、Snowflake、GitHub、Atlassian、Stripe 等工具,并允许添加自定义 MCP 服务器。

    推荐理由:原文给出了连接器目录、自定义 MCP 扩展和记忆功能的具体能力与开放入口,读者可据此判断如何把工作流接入 Le Chat。

9月1日周一
  1. Berkeley AI Research38

    word2vec 究竟学到了什么?新理论证明其等价于 PCA 矩阵分解

    一项新研究首次为 word2vec 提供了定量预测理论,证明在现实训练条件下,其学习问题可简化为无权重最小二乘矩阵分解,最终学到的表示由 PCA 给出。从随机小初始化训练时,word2vec 按离散步骤依次学习正交线性子空间,每个特征对应可解释的主题概念,且这些特征可闭式求解为特定矩阵的特征向量。

8月1日周五
7月30日周三
  1. Mistral AI62

    Mistral 发布 Codestral 25.08 及完整企业编码栈

    Mistral 发布 Codestral 25.08,接受补全提升 30%、保留代码增加 10%、失控生成减少 50%,并推出包含 Devstral、Codestral Embed 和 Mistral Code 插件的完整企业编码栈,支持云端、VPC 或本地部署。Capgemini、Abanca、SNCF 等企业已在生产环境使用该方案。

    推荐理由:原文给出了 Codestral 25.08 的量化提升和完整企业级编码栈的部署方式,读者可据此评估自托管方案的价值。

7月23日周三
7月17日周四
  1. Mistral AI62

    Mistral 发布 Le Chat 多项新功能,含 Deep Research、语音模式与图像编辑

    Mistral 为 Le Chat 推出多项新功能:Deep Research 预览模式可生成结构化研究报告,语音模式由新模型 Voxtral 驱动,Think 模式由推理模型 Magistral 提供多语言思考能力,Projects 用于组织对话,并与 Black Forest Labs 合作支持直接在聊天内编辑图像。所有新功能现已在 chat.mistral.ai 及移动应用上线,无需信用卡。

    推荐理由:官方一口气上线五项新能力,读者可据此判断 Le Chat 在深度研究、语音和图像编辑上的完整能力版图。

7月15日周二
  1. Mistral AI78

    Mistral 发布开源语音理解模型 Voxtral,提供 24B 与 3B 两个版本

    Mistral AI 发布开源语音理解模型 Voxtral,提供 24B 生产级和 3B 端侧两个版本,均采用 Apache 2.0 许可并开放 API。Voxtral 支持 32k token 上下文、最长 30 分钟转写或 40 分钟理解、内置问答与摘要、多语言识别及语音直接触发函数调用。

    推荐理由:原文给出了两个开源语音模型的规模、许可和定价,读者可据此评估其在生产场景中的成本与部署选择。

7月11日周五
7月3日周四
6月11日周三
6月10日周二
6月4日周三
  1. Mistral AI67

    Mistral 发布企业级 AI 编程助手 Mistral Code

    Mistral 发布企业级 AI 编程助手 Mistral Code,整合 Codestral、Devstral 等四款模型与 IDE 插件、本地部署和企业工具,支持微调与私有化部署。产品基于开源项目 Continue 构建,今日开放 JetBrains 和 VSCode 的私有测试,已获 Abanca、SNCF 和 Capgemini 等企业采用。

    推荐理由:原文给出了产品定位、部署方式和客户案例,读者可以据此判断企业级 AI 编程助手市场的竞争格局。

5月28日周三
  1. Mistral AI62

    Mistral 发布首个代码专用嵌入模型 Codestral Embed

    Mistral AI 发布 Codestral Embed,这是其首个专为代码设计的嵌入模型,在真实代码数据的检索场景中表现突出,显著优于 Voyage Code 3、Cohere Embed v4.0 和 OpenAI 的大型嵌入模型。

    推荐理由:原文给出了首个代码专用嵌入模型的性能对比、定价和分块建议,读者可据此评估其在代码检索场景的适用性。

5月27日周二
  1. Mistral AI65

    Mistral 发布 Agents API,支持代码执行、联网搜索与多智能体编排

    Mistral 发布 Agents API,将语言模型与代码执行、网页搜索、图像生成、MCP 工具等内置连接器结合,提供跨对话持久记忆与智能体编排能力。该 API 支持多智能体动态协作与任务交接,并展示编码助手、财务分析等应用案例。启用联网搜索后,Mistral Large 与 Medium 在 SimpleQA 基准上的准确率分别从 23% 和 22.08% 提升至 75% 和 82.32%。

    推荐理由:官方发布面向企业的智能体编排框架,读者可据此评估其内置连接器与多智能体协作能力。

5月21日周三
  1. Mistral AI75

    Mistral AI 发布开源编码智能体 Devstral

    Mistral AI 与 All Hands AI 合作推出面向软件工程任务的智能体大模型 Devstral,在 SWE-Bench Verified 上取得 46.8% 的成绩,超过此前开源最优模型 6 个百分点以上,并以 Apache 2.0 协议免费开源。

    推荐理由:原文给出了基准成绩、开源许可和本地部署门槛,读者可据此评估它作为开源编码智能体的实际可用性。

5月7日周三
  1. Mistral AI74

    Mistral AI 发布 Mistral Medium 3,主打低成本高性能

    Mistral AI 发布 Mistral Medium 3,在多数基准上达到 Claude Sonnet 3.7 的 90% 以上性能,定价为每百万 token 输入 $0.4、输出 $2,成本显著更低。该模型在编码和 STEM 任务上接近更大规模的竞品,并支持混合部署或本地 VPC 部署,API 即日起在 Mistral La Plateforme 和 Amazon Sagemaker 上线。

    推荐理由:原文给出了性能对比和定价,读者可以据此判断中等规模模型在成本与能力之间的取舍。

4月9日周三
  1. Mistral AI38

    Mistral 评估 RAG 系统:以 LLM 为裁判与 RAG Triad 框架

    Mistral 探讨如何用“LLM As A Judge”方法评估 RAG 系统,通过裁判模型按数值、二元或定性量表为生成答案打分。文章介绍了 RAG Triad 框架,从上下文相关性、接地性和答案相关性三个维度检查检索与生成质量。Mistral 的模型可同时充当生成器和裁判,其 API 的结构化输出功能可用于构建更可靠的评估流程。

3月17日周一
  1. Mistral AI72

    Mistral Small 3.1 发布:128k 上下文、多模态、Apache 2.0 开源

    Mistral AI 发布 Mistral Small 3.1,在文本性能、多模态理解和 128k 上下文窗口上较前代升级,推理速度达每秒 150 tokens,性能超越 Gemma 3 和 GPT-4o Mini,并以 Apache 2.0 许可开源。

    推荐理由:官方公布了性能对比、推理速度和开源许可,读者可据此判断它相对同类小模型的定位与适用场景。

3月7日周五
  1. Mistral AI75

    Mistral 发布 OCR API,支持多模态文档理解与自托管

    Mistral 发布 Mistral OCR,一个光学字符识别 API,可理解文档中的媒体、文本、表格和公式,并输出有序的交错文本与图像。API mistral-ocr-latest 定价为 1000 页/美元,批量推理约翻倍,已在 la Plateforme 上线,并成为 Le Chat 的默认文档理解模型。

    推荐理由:原文给出了 Mistral OCR 的基准对比、定价和自托管选项,读者可据此判断它相对现有 OCR 服务的定位。

3月4日周二