跳到正文

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

25条精选相关主题模型发布行业动态AI 编码

最新精选

第 1–20 条 · 共 25 条
今天9月29日周二
  1. AWS Machine Learning Blog70

    Grok 4.7 上线 Amazon Bedrock,支持 500K 上下文与四级推理强度

    xAI 的 Grok 4.7 现已上线 Amazon Bedrock,提供 500K token 上下文窗口,支持 low、medium、high、xhigh 四级推理强度,可通过 Responses、Chat Completions 和 Converse API 调用。

    推荐理由:原文给出了模型能力、接入方式和成本控制要点,读者可据此判断如何在 Bedrock 上使用 Grok 4.7。

9月25日周五
  1. GitHub Blog · AI & ML78

    GitHub Security Lab 发布 Taskflow Agent 驱动的 AI 模糊测试管线

    GitHub Security Lab 发布 Fuzzing Taskflow,一个基于 Taskflow Agent 框架的 C/C++ 项目自动化模糊测试管线,只需指向 GitHub 仓库即可自动识别入口点、编写 harness、运行 AFL++、分析覆盖率并分类崩溃。

    推荐理由:原文给出了完整的架构分层和覆盖反馈循环设计,读者可据此判断这套自动化模糊测试管线的可迁移价值。

  2. Google DeepMind62

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,为对话模型加入实时视频形象

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,为原生实时对话模型加入近实时视频生成能力,可边听边看边用动态视觉形象说话。该功能支持精确唇形同步、自然表情和流畅轮换,并可在后台异步调用工具的同时保持对话不中断。即日起在 Gemini Enterprise 中可用,支持跨 97 种语言无缝切换,所有输出均带 SynthID 水印。

    推荐理由:原文给出了实时视频形象、异步工具调用和 97 语言同步等能力细节,读者可据此判断企业客服等场景的落地方式。

9月24日周四
  1. NVIDIA Blog75

    NVIDIA 联合 Google DeepMind 等机构发布 2800 多种病毒蛋白复合物 3D 结构开放数据集

    NVIDIA 联合 Google DeepMind、EMBL-EBI 等机构,通过 AlphaFold Database 开放了 2800 多种病毒的蛋白复合物预测 3D 结构,供全球任何科学家使用。

    推荐理由:原文给出了数据集规模、开放入口和可复用的推理流程,读者可据此评估它对病毒研究和疫情准备的实际价值。

  2. Google DeepMind62

    Google 为 Private AI Compute 引入安全服务端内存,实现跨设备持久记忆

    Google 公布 Private AI Compute 架构更新,新增安全服务端内存层,让 AI 助手在云端获得跨设备持久记忆,同时保持设备端隐私标准。数据被密封在加密存储中,解锁密钥仅存于个人设备,即使 Google 也无法访问;处理时通过端到端加密通道在安全隔离区临时解密,随后立即重新加密。Google 还发布了防篡改的服务器软件公开记录及独立安全审计结果,供社区验证。

    推荐理由:原文给出了加密存储与设备端密钥分离的架构细节,读者可据此判断云端持久记忆的隐私边界。

9月23日周三
  1. Google DeepMind75

    Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 语音生成模型

    Google DeepMind 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,支持用自然语言提示从零创建自定义角色声音、逐行导演表演,并覆盖 100 多种语言。

    推荐理由:原文给出了两款新语音模型的能力边界、开放入口和评测排名,读者可据此判断其适用场景。

9月22日周二
  1. NVIDIA Blog62

    NVIDIA Isaac ROS 5.0 发布,引入智能体工作流并支持 ROS Lyrical

    NVIDIA 在 ROSCon 大会上发布 Isaac ROS 5.0,这是一套基于 ROS 的 GPU 加速开源包,新增智能体工作流和平台支持,帮助开发者更快构建、定制和部署机器人应用。

    推荐理由:原文给出了 Isaac ROS 5.0 的智能体工作流、ROS Lyrical 支持和生态伙伴落地案例,读者可据此判断它如何加速机器人开发。

  2. Hugging Face Blog73

    Hugging Face transformers 支持运行 llama.cpp 的 GGUF 量化模型

    Hugging Face 在 transformers 中加入对 GGUF 模型的高效运行支持,通过复用 ggml 的 Metal 内核,可在 Apple Silicon 上以熟悉的 from_pretrained 接口加载并生成。

    推荐理由:原文给出了 GGUF 加载方式、性能对比和当前限制,读者可以据此判断在 transformers 里跑本地量化模型的可行性与适用场景。

  3. NVIDIA Blog62

    NVIDIA 发布 Halos 全栈安全系统,覆盖自动驾驶与机器人部署

    NVIDIA 发布 Halos,称其为首个且唯一的物理 AI 全栈安全系统,覆盖硬件、操作系统、端到端模型、仿真验证等各层。面向自动驾驶,Halos 基于 DRIVE AGX Thor 与 Hyperion 平台;面向机器人,基于 IGX Thor 与 Halos Core。

    推荐理由:原文梳理了物理 AI 规模化部署所需的安全分层,并给出 NVIDIA Halos 在自动驾驶与机器人两大领域的完整架构与认证进展。

9月21日周一
9月17日周四
  1. GitHub Blog · AI & ML85

    GitHub 用 Copilot 将 Copilot 运行时重写为 Rust

    GitHub 用 Copilot 将 Copilot 运行时从 TypeScript 重写为超过 80 万行生产 Rust,历时约 14.5 周,由一名开发者主导完成。重写采用组件级就地替换策略,性能提升数个数量级,并新增 C ABI 支持进程内嵌入。

    推荐理由:原文给出了用 Copilot 自身完成大规模 Rust 重写的完整过程与数据,读者可据此评估 AI 辅助重写的可行性与工程方法。

9月16日周三
  1. Mistral AI60

    Mistral 与 Mozilla 合作,为 Firefox 智能窗口提供模型支持

    Mistral 宣布与 Mozilla 合作,为 Firefox 的 AI 浏览助手 Smart Window(测试版)提供模型支持,初期覆盖法国和北美用户,英国和德国预计今年晚些时候跟进。双方强调开源、隐私与用户控制,对话默认不保存在 Mozilla 服务器,合作伙伴同意零数据留存。

    推荐理由:原文给出了合作范围、地区上线顺序和隐私默认设置,读者可据此判断开源模型进入浏览器助手后的实际形态。

  2. NVIDIA Blog62

    曼彻斯特大学用 NVIDIA Earth-2 预测英国空气污染

    曼彻斯特大学团队利用 NVIDIA Earth-2 的生成式模型 CorrDiff 和 StormCast,在 Isambard-AI 超级计算机上训练出覆盖全英国的空气污染预测模型,分辨率达 2-3 平方公里,训练耗时仅两天。该模型还能在 DGX Spark 桌面系统上运行,团队计划开源训练数据和工作流,并探索与边缘 AI 设备结合实现实时决策。

    推荐理由:原文展示了生成式模型在空气污染预测上的首次落地,读者可借此了解生成式框架从天气迁移到污染领域的可行路径。

9月8日周二
  1. Google DeepMind83

    Google DeepMind 发布 AlphaGenome Atlas,预测人类基因组全部单核苷酸变异影响

    Google DeepMind 发布 AlphaGenome Atlas 平台,包含人类基因组中 90 亿个单核苷酸变异的分子效应预测,并推出 AVI 评分用于快速排序变异影响。该平台以 1PB 数据集形式提供,面向学术研究免费开放,可通过网站门户、AlphaGenome API 及 Google Antigravity 技能访问,商业用途即将在 Google Cloud 上线。

    推荐理由:原文给出了覆盖全基因组 90 亿单核苷酸变异的预测平台及其开放入口,读者可据此判断它在罕见病和复杂性状研究中的可用范围。

9月5日周六
  1. GitHub Blog · AI & ML78

    GitHub 推出 Project HydraFusion 研究预览,通过多模型编排实现前沿质量

    GitHub 推出 Project HydraFusion 研究预览,通过运行时编排在多个提供商的模型中选择执行计划,以平衡质量、成本与延迟。它支持 Single、Cascade、Critique 三种执行模式,在 TerminalBench 2.1 上相比 Claude Opus 5 提升 4.9 个百分点且成本降低 67%。

    推荐理由:原文给出了多模型编排的三种执行模式与基准测试结果,读者可据此判断它在质量与成本之间的取舍。

9月3日周四
  1. Google DeepMind62

    Google DeepMind 推出 Fairwind 计划,向政府和合作伙伴开放高级网络防御能力

    Google DeepMind 今日推出 Fairwind 计划,这是一个面向政府和受信任合作伙伴的有限访问项目,提供其最先进的网络防御能力。该计划首先让防御者使用 Gemini 3.8 Flash Cyber 模型和 CodeMender 工具,自主发现并修复漏洞,在组织安全云环境中几分钟内生成可部署的补丁。

    推荐理由:原文给出了 Fairwind 计划的准入对象、能力组合和开放范围,读者可据此判断该计划对自身组织的适用性。

8月21日周五
  1. Microsoft Research62

    微软研究院发布 Skala 1.1,扩展 DFT 精度与软件集成

    微软研究院发布深度学习 DFT 泛函 Skala 1.1,训练数据量为此前版本的 2.5 倍,在 GMTKN55 基准的 55 个类别中 32 项排名第一,加权平均误差为 2.8 kcal/mol,精度超越主流全局杂化泛函。Skala 现已集成至 CP2K,并正在集成到 Psi4、FHI-aims、ORCA 和 VASP,同时推出持续更新的性能基准报告。

    推荐理由:微软研究院发布 Skala 1.1,训练数据扩充 2.5 倍,并推进多款量子化学软件的集成,读者可据此评估其精度与可用性。

8月20日周四
  1. Mistral AI72

    Mistral 发布 Agentic Search,提升复杂文档检索准确率并降低延迟

    Mistral 发布 Agentic Search,一个多步骤检索层,让模型能搜索、导航、读取并验证复杂文档中的信息。在 FinanceBench 上,准确率从 26.7% 提升至 86%,OfficeQA Pro 上提升 45.6 个百分点;p90 延迟降低最多 39.6%,token 消耗减少三分之一。

    推荐理由:官方给出了基准测试的准确率、延迟和 token 消耗数据,读者可据此判断 Agentic Search 相比传统 RAG 的实际收益。

8月11日周二
  1. Mistral AI62

    Mistral 推出区域推理端点与优先级层级,并接入第三方开源模型

    Mistral 宣布三项推进 AI 主权的新举措:区域推理端点 Mistral Regional Endpoints 正式可用,允许客户选择推理在欧洲或美国运行;Mistral Priority Tier 进入公开预览,为关键任务负载提供承诺服务级别和可用性 SLA。

    推荐理由:原文给出区域端点、优先级层级和第三方开源模型接入的具体安排,读者可据此评估欧洲主权 AI 基础设施的落地路径。