NVIDIA 验证工程师 Sakeena Fiza:让硬件在规模化部署中成功运行
NVIDIA 验证工程师 Sakeena Fiza 的工作是在量产前确保物理设备正确运行,她将验证过程形容为“成为产品的第一批客户”,在真实条件下极限测试硬件,目标是在客户发现问题之前提前捕获故障。她曾见证 NVIDIA Rubin GPU 首次在系统层面完成枚举,并指出单块板卡含数万组件、单个机架接近 50 万组件,验证工作横跨固件、硬件、软件、机械设计、热行为、制造与客户体验。
NVIDIA 验证工程师 Sakeena Fiza 的工作是在量产前确保物理设备正确运行,她将验证过程形容为“成为产品的第一批客户”,在真实条件下极限测试硬件,目标是在客户发现问题之前提前捕获故障。她曾见证 NVIDIA Rubin GPU 首次在系统层面完成枚举,并指出单块板卡含数万组件、单个机架接近 50 万组件,验证工作横跨固件、硬件、软件、机械设计、热行为、制造与客户体验。
OpenAI 将 Daybreak 项目访问权限扩展至乌克兰政府,以支持民用基础设施的网络防御。该项目此前已面向部分合作伙伴开放,此次新增乌克兰政府作为受益方,旨在帮助其应对针对关键民用系统的网络威胁。
GPT-6 Astra 能生成结构更清晰、更贴合语境的 legal 文档,让律师得以专注于策略层面。Harvey 将这一模型能力应用于法律实务,提升了草稿质量。
Ringg 借助 OpenAI 的 GPT-5.6,在语音、聊天、WhatsApp 和网页端部署多语言 AI 智能体,能自主解决高达 65% 的客户来电。相比 GPT-4.1,其成本降低 90%。
invideo 借助 GPT-6 Astra 实现更精准的剪辑规划,调色与校色效率提升 3 倍,并可在一天内生成 50 个自定义特效。
OpenAI CEO Sam Altman 在联合国安理会发表讲话,讨论 AI 安全、人类控制与国际合作。他强调在 AI 快速发展背景下,确保人类对 AI 系统的控制至关重要,并呼吁各国加强协作以应对全球性挑战。
OpenAI 发布 MentalHealthBench,一个由专家参与设计的评测基准,用于评估 AI 在真实心理健康对话场景中提供有帮助且安全回应的能力。该基准聚焦于现实对话情境,旨在衡量模型在心理健康支持中的实用性与安全性。
NVIDIA AI Day Singapore 于 9 月 22-23 日在新加坡莱佛士城会议中心举行,NVIDIA 与合作伙伴展示东南亚地区的 AI 突破。
ChatGPT Ads 扩展至东南亚和台湾地区,为符合条件的商家提供触达 60 多个国家用户的新方式。
Airbnb 正扩大对 GPT-6 Astra 及 OpenAI 前沿模型的访问权限,帮助工程团队解决 bug、设计系统并加快交付速度。此举旨在让更多内部团队直接调用这些模型,提升开发效率与产品迭代节奏。
OpenAI 与 Grab 联合推出“GO Forward with AI”区域计划,帮助东南亚 3 万名合作伙伴掌握实用 AI 技能。该计划旨在通过培训提升当地合作伙伴的 AI 应用能力,推动区域数字化转型。
GPT-6 改进了提示词缓存机制,实现更高的缓存命中率,并新增诊断工具、显式断点及控制选项,以降低延迟和成本。这些功能旨在帮助开发者更高效地管理缓存行为,优化 API 调用性能。
OpenAI 的 GPT-6 Sol 和 GPT-6 Luna 现已在 Amazon Bedrock 上正式可用,两者 API 定价均显著低于 GPT-5.6 前代。
推荐理由:原文给出了两款模型的分工定位、降价幅度和提示词缓存能力,读者可据此判断如何按负载匹配模型。
OpenAI 发布 GPT-6 Sol 和 Luna 两款模型,以不同的能力与成本平衡将前沿智能带入日常工作。
Claude Opus 5.5 现已在 Amazon Bedrock 和 Claude Platform on AWS 上线,是 Claude 5.5 系列的首个模型。相比 Opus 5,它用更少 token 完成任务,平均单任务成本更低,并首次配备生物、网络安全和 AI 开发领域的安全分类器。模型支持自适应思考,可通过 effort 控制推理量,适用于智能体编码和长文档知识工作。
推荐理由:原文给出了新模型的效率、定价与安全分类器变化,读者可据此评估其在长任务和智能体编码场景的适用性。
NVIDIA 在 ROSCon 大会上发布 Isaac ROS 5.0,这是一套基于 ROS 的 GPU 加速开源包,新增智能体工作流和平台支持,帮助开发者更快构建、定制和部署机器人应用。
推荐理由:原文给出了 Isaac ROS 5.0 的智能体工作流、ROS Lyrical 支持和生态伙伴落地案例,读者可据此判断它如何加速机器人开发。
GPT-6 Astra 使 Parallel 的智能体在研究和综合劳动力市场数据时,时间和成本均较此前模型降低一半。该结果来自 Parallel 的实际应用,体现了新模型在数据密集型任务上的效率提升。
oMLX 创建者及维护者 Jun Kim 加入 Hugging Face,以支持 MLX 社区。oMLX 将保持 Apache 2.0 开源协议,并由 Jun 继续主导开发,从兼职项目升级为全职维护项目,有望带来更稳定的发展和更快的迭代。Hugging Face 希望 oMLX 成为新想法的试验场,并加速 transformers 模型定义到 MLX 实现的转换。
OpenAI 公布了针对前沿模型及其安全防护措施开展严格、安全且独立的第三方 AI 安全评估的优先事项与原则。该框架旨在规范外部评估流程,确保评估的严谨性与独立性。
Hugging Face 在 transformers 中加入对 GGUF 模型的高效运行支持,通过复用 ggml 的 Metal 内核,可在 Apple Silicon 上以熟悉的 from_pretrained 接口加载并生成。
推荐理由:原文给出了 GGUF 加载方式、性能对比和当前限制,读者可以据此判断在 transformers 里跑本地量化模型的可行性与适用场景。
英国 AI 安全研究所(AISI)开始通过 EvalEval 的 Evaluation Cards 平台公开共享评估结果,以提升评估科学的可复现性与可验证性。
NVIDIA 推出 DSX Ready 认证计划,用于对符合 NVIDIA DSX AI 工厂参考设计要求的合作伙伴产品进行资格认证。计划启动时包含电池储能系统(BESS)和冷却分配单元(CDU)两个类别,首批合格厂商包括 Hitachi Energy、LG Energy Solution、Tesla 以及 LG Electronics、LiquidStack、Vertiv。
NVIDIA 发布 Halos,称其为首个且唯一的物理 AI 全栈安全系统,覆盖硬件、操作系统、端到端模型、仿真验证等各层。面向自动驾驶,Halos 基于 DRIVE AGX Thor 与 Hyperion 平台;面向机器人,基于 IGX Thor 与 Halos Core。
推荐理由:原文梳理了物理 AI 规模化部署所需的安全分层,并给出 NVIDIA Halos 在自动驾驶与机器人两大领域的完整架构与认证进展。
埃及AI生态正从潜力走向规模化生产,NVIDIA在开罗举办活动展示其全栈AI方案。过去一年,NVIDIA深度学习学院在埃及的学习者数量增长超十倍;Hassan Allam Data Centers获许可建设数据中心,预计投资4亿美元。非洲一年内新增四座AI工厂,另有656兆瓦容量在建,Cassava Technologies等企业正推动本地化AI基础设施部署。
微软研究团队在 Nature 发表逆合成预测模型 RetroChimera,结合 Transformer 模型 R-SMILES 2 与图神经网络模型 NeuralLoc,通过学习排序整合两者预测。盲测中博士级化学家更偏好其单步反应预测,多步合成路线在十个挑战性目标中成功九个。模型已开源(MIT 许可),并可通过 Microsoft Foundry 访问。
推荐理由:原文给出了模型架构、开源信息和专家盲测结果,读者可据此判断它在逆合成预测上的实际表现。
NVIDIA 提出 AI 安全本质是工程问题,需在智能体栈的每一层(模型、工具、运行时环境)落实可执行的安全边界、责任人与防护证据。NVIDIA 开源 OpenShell 安全运行时,在智能体触及范围之外强制策略并提供沙箱执行;Cisco DefenseClaw、JFrog 等合作伙伴正基于 OpenShell 构建治理与技能扫描层。
Multiverse Computing 发表论文,将大语言模型的块删除(深度剪枝)重构为约束二元优化问题,映射到伊辛玻璃自旋系统,用能量作为下游性能的廉价代理,从而无需逐一基准测试即可筛选大量候选配置。
推荐理由:把剪枝块选择映射为伊辛玻璃能量最小化,用物理求解器处理组合问题,在深度压缩下显著领先现有方法。
Higgsfield AI 借助 GPT-6 Astra 在一天内推出新视频功能,让小型企业更轻松地制作视频广告,并加速新创意工具上市。该合作显著缩短了从构思到上线的周期,提升了产品迭代速度。
OpenAI 正与一个独立的数学与人工智能咨询小组合作,以指导新兴 AI 成果的审查与沟通工作。该小组将协助 OpenAI 评估和传达最新 AI 研究结果,确保相关信息的准确性与透明度。
NVIDIA 在纽约气候周上展示了五家将 AI 融入清洁能源项目的公司。ThinkLabs AI 利用数字孪生和智能体,将电网互联申请评估时间从 30-45 天缩短至两分钟。
OpenAI 提出构建全球共享 AI 标准的路径,呼吁通过协调一致的评估、报告与治理机制来提升安全性。该倡议聚焦于建立统一框架,以应对 AI 快速发展带来的风险与挑战。
OpenAI Academy 推出面向员工、开发者、领导者、教育者和学生的新学习路径,帮助用户构建并展示实用 AI 技能。这些路径覆盖不同角色需求,旨在提升各领域人群的 AI 应用能力。
Hugging Face 发布 tokenizers v1 的候选版本,编码路径比 v0.23 快 3 到 30 倍,在 Apple M4 Max 上八线程扩展效率为线性扩展的 76%,且输出 token ID 与旧版完全一致。
推荐理由:原文给出了 v1 相比 v0.23 的编码提速幅度和实现原理,读者可据此判断升级收益与适用场景。
V7 利用 GPT-5.6 将散落的公司文件转化为智能体可用的上下文,以完成复杂且可溯源的工作。该方案使成本降低 78%,同时提升了准确性。
Google Research 推出 MilleMiglia,一个用 C++ 编写的实例生成器,旨在为中间一英里配送问题创建现实基准。该工具模拟中段物流中货物在区域配送中心间的批量运输与多车接力,生成隐私保护数据,弥补该领域公开高质量数据的缺失。源代码与文档已发布于 GitHub。
GitHub Podcast 最新一期拆解五大 AI 热论:AI 生成代码仍需人工审查、不会用 AI 未必影响求职、Skills 与 MCP 解决不同问题、RAG 未死、代码库难懂或反映可维护性问题。节目主张用提问代替站队,在真实工作中检验观点。
OpenAI 推出澳大利亚青少年安全蓝图(Australian Youth Safety Blueprint),这是一份包含六大支柱的路线图,旨在为青少年提供更安全的 AI 体验,保护并赋能年轻用户。
Google Research 发布新研究实验,利用生成式UI(GenUI)让教师创建定制化、交互式的教育模拟,并推出超过30个面向中学STEM学科的英语学习交互示例库。
推荐理由:原文展示了生成式UI在教育场景的应用路径,读者可了解其教学设计和质量保障机制。
Pawprint Studio 的开放世界抓宠 RPG《Aniimo》本周登陆 GeForce NOW,玩家无需等待 45GB 下载即可在 Steam Deck、Firefox 浏览器等设备上串流游玩。
Cooley 基于 ChatGPT Work 构建了 GO Public,将智能引入 IPO 流程,帮助律师更早发现问题,并将判断力聚焦于最关键环节。