Your current location:Home > 斯巴达克斯第三季 text

娱乐百分百

有了TPU还不够,谷歌开始为Gemini 独造芯片:推理能效或达6到10倍_我的网站

大众点评

A |     谷歌正在尝试把 Gemini 与芯片更紧密地结合起来。    

IT之家 8 月 22 日消息,领克汽车昨晚发布《关于主动召回特定批次车辆的情况说明》,回应主动召回领克 900 等车型。         据《The Information》援引知情人士消息,谷歌母公司 Alphabet 正在研发一款服务器 AI 芯片,内部非正式代号为“Frozen v2”。公告称,近期,我们在主动排查及用户反馈中发现,部分搭载激光雷达的车辆在特殊场景下可能出现辅助驾驶功能受限的情况。这款芯片针对 Gemini 模型设计,计划最早于 2028 年部署。对此我们高度重视,迅速组织内部技术团队与供应商联合展开全面核查。经分析,由于供应商制程工艺波动,特定批次激光雷达的内部元器件 (电源 IC) 可能存在损伤。

B | 基于系统的安全设计,车辆会在特殊场景下触发辅助驾驶限速保护,并在大屏和仪表通过文字、提示音等方式提醒。据悉,领克已主动向国家市场监督管理总局备案召回计划,将通过电话、短信等形式与车主取得联系,并且通过云端平台识别预警,主动邀约用户,免费更换激光雷达,同时提供上门取送车及优先排队专属服务。谷歌工程师预计,以单位功耗所能处理的 Token 数量计算,其效率可能达到公司最新一代自研 AI 芯片的 6—10 倍。IT之家附说明主要内容:1、我的车是否在召回范围?如何确认?本次召回涉及的车辆生产日期范围如下:领克 900:2025 年 1 月 8 日至 2025 年 10 月 25 日领克 10EM-P:2025 年 8 月 1 日至 2025 年 11 月 3 日领克 07EM-P:2025 年 8 月 20 日至 2025 年 11 月 14 日领克 08 EM-P:2025 年 8 月 20 日至 2025 年 12 月 10 日领克将通过云端平台识别早期诊断信号,对可能存在故障的车辆触发预警,并通过 400 客服主动电话或短信联系您。如果您未收到通知,也可致电领克客服热线 (400-601-0101) 或联系当地授权经销商查询。2、未收到进店服务信息前,我的车辆能正常使用吗?可以正常使用,激光雷达主要为高阶辅助驾驶功能(如高速 NOA、城市 NOA)提供环境感知数据。当雷达出现异常时,车辆会在大屏和仪表通过文字、提示音等方式提醒用户,并自动限制组合驾驶辅助时的最高车速。         谷歌目前尚未正式确认 Frozen v2 项目,也没有公布芯片规格。不开启 NOA 状态下,车辆行驶完全正常,不受任何影响。请您在日常使用中按习惯驾驶即可,收到召回通知后及时进店处理。公司在回应媒体时表示,其团队一直在研究和试验提升性能与效率的新方案,但并非所有项目最终都会进入生产阶段。3、本次召回启动时间和处置措施是什么?从 2026 年 8 月 24 日起,针对召回范围内的车辆,我们将通过电话、短信等方式尽快与您联系,为您免费更换全新激光雷达,并为您提供上门取送车及优先排队专属服务。谷歌同时强调,从底层共同设计硬件和软件,是其打造高度集成系统的重要方式。但报道发布后,Alphabet 股价在当地时间 7 月 20 日早盘上涨约 3.3%。         与现有 TPU 相比,Frozen v2 的主要区别,是它进一步收窄了芯片的适用范围。

C | 它的定位是一颗更极致的“专用芯片”。

D | 根据现有报道,谷歌计划将 Gemini 的部分架构特征固化在芯片中,针对其计算路径和常用操作进行专门优化。4、最近已经更换过激光雷达,还需要更换吗?如果您近期已在授权经销商处完成激光雷达更换,无需再次进店,请放心使用。         大模型推理不仅需要完成大量矩阵运算,还要频繁从高带宽内存读取参数。5、更换后,会影响激光雷达质保吗?更换后的新激光雷达随整车质保,质保周期与车辆原有质保保持一致,不会因本次召回维修而缩短或重置。数据在内存与计算单元之间移动,会消耗时间和电力。

。Frozen v2 希望减少这部分开销,从而提高响应速度,并在相同功耗下处理更多请求。报道所称的 6—10 倍效率提升,具体指每单位功耗能够处理的 Token 数量,并不是芯片峰值算力。         谷歌现有 TPU 同样是面向机器学习的专用处理器,但需要适配不同模型,并承担训练、推理等多种任务。最新一代 Ironwood 单颗芯片配备 192GB 高带宽内存,单位功耗性能约为上一代 Trillium 的两倍,最多可由 9216 颗芯片组成 Superpod。Frozen v2 不会取代 TPU,而是作为一条更具针对性的产品线,与其并行使用。

E |          (来源:Google)          但专用芯片也有其劣势,更深的模型与芯片绑定会降低灵活性。芯片从设计到投产通常需要数年,如果此后 Gemini 的基础架构发生较大变化,已经固化的设计可能难以适配。Frozen v2 能否获得长期收益,既取决于实际能效,也取决于谷歌能否在快速迭代模型的同时,维持底层架构的相对稳定。         那么,谷歌为什么要“铤而走险”?首先一个原因,是为了应对持续增长的算力需求。

F | 据相关数据,谷歌内部的 AI 计算资源短缺已经引发不同团队之间的资源竞争,Google Cloud 甚至因此拒绝过部分外部客户订单。         大模型的计算需求包括训练与推理两个阶段。训练先进模型需要集中投入大量算力,但随着 Gemini 被加入搜索、办公软件、云服务和智能终端,长期发生的推理可能形成更庞大的成本。单次生成的费用看似有限,乘以数以亿计的用户和持续增长的调用量后,电力、芯片、网络及数据中心投入都会成为重要支出。         Alphabet 已将 2026 年资本开支预期上调至 1,800 亿—1,900 亿美元,主要用于扩建 AI 计算能力、数据中心和相关基础设施。在这一背景下,提高每瓦电力能够生成的 Token 数,不仅意味着更低的能源消耗,还意味着同一座数据中心能够承载更多用户请求。对于已经拥有大量 Gemini 使用场景的谷歌而言,即使单次推理成本只下降一小部分,规模化之后也可能带来可观节省。         图|谷歌历年资本开支预期(来源:S&P)          自研芯片还可以加强谷歌对供应链和产品节奏的控制,减少对英伟达等外部芯片供应商的依赖。

G | 但这种“减少依赖”并不等于完全替代。Frozen v2 即使顺利投产,预计规模也将低于 TPU;谷歌的数据中心仍会同时使用 TPU、GPU 及其他计算设备。它更像是为高频且相对稳定的 Gemini 任务增加一类成本更低的专用工具。         谷歌也不是唯一走向自研芯片的 AI 公司。

H | 2026 年 6 月,OpenAI 与博通公布首款自研推理芯片 Jalapeño。

I | OpenAI 表示,这款芯片围绕大语言模型推理设计,将结合博通的芯片实现和网络技术以及 Celestica 的服务器系统能力,计划于 2026 年底开始部署。

J |          图|博通公司首席执行官 Hock Tan 将一片芯片晶圆递交给 OpenAI 公司首席执行官 Sam Altman。(来源:OpenAI)          Anthropic 也被曝已经开始研究自有 AI 芯片,并与三星电子等潜在合作方接触。不过该项目仍处于早期阶段,芯片的用途、性能目标和服务器部署方式尚未明确 Anthropic 同时表示,亚马逊 Trainium、谷歌 TPU 和英伟达 GPU 仍将是其扩张算力的重要基础。中国方面,此前 DeepSeek 和近期的月之暗面也有自研芯片方面的传闻。         除专注于基础模型的公司外,亚马逊、微软、Meta、阿里巴巴、百度和字节跳动等拥有云服务或大规模互联网业务的企业,也在不同程度上推进专用 AI 芯片。其中部分芯片服务于模型训练,部分集中于推理、推荐和广告等高频工作负载。它们共同反映出一个趋势:随着 AI 服务规模扩大,掌握模型的公司越来越希望同时参与芯片和计算系统设计。         这些项目属于同一轮趋势:AI 公司希望根据自身模型和业务负载设计芯片,以获得更好的成本、能效和供应保障。但它们并不是完全相同的技术路线。Trainium、Maia、MTIA 以及 OpenAI 的 Jalapeño 主要面向一类或多类 AI 工作负载,仍保留一定通用性;Frozen v2 则称会把 Gemini 的部分架构直接固化进硬件,模型与芯片的绑定程度可能更高。         因此,Frozen v2 所代表的不只是谷歌扩大自研芯片投入,也是一项更激进的软硬件协同试验。答案将取决于芯片能否如期投产,也取决于到 2028 年时,Gemini 是否仍然适合这块为它提前设计的硅片。         参考链接:          1.https://techcrunch.com/2026/07/20/google-is-working-on-a-new-ai-chip-designed-to-make-gemini-more-efficient/          2.https://www.reuters.com/business/google-plans-new-chip-run-gemini-models-more-efficiently-information-reports-2026-07-20/          3.https://blog.google/innovation-and-ai/infrastructure-and-cloud/google-cloud/ironwood-tpu-age-of-inference/          4.https://blog.google/innovation-and-ai/infrastructure-and-cloud/google-cloud/ironwood-google-tpu-things-to-know/          运营/排版:何晨龙          注:封面由 AI 辅助生成。

Current article:http://y3i9ix.dinggaxilianmaiyuejienianguai.shop/tpxf/uf0k3j9.html

Published on:04:03:14


 Live broadcast Hall
·免费AI建站与内容工具:不会写代码、不会写文章,AI全包了
·「山に置き去りにされた少年を保護している」小学生の男の子を山に置き去りにしたか…母親と交際相手を逮捕=静岡県警
·内蒙古兴和县车辆落水共造成5人死亡
·两厢电动小钢炮 标致e-208GTi将于6月13号正式发布!
·中埃空军联训万里畅通,中东“开绿灯”成亮点,兵器评论,原创 中埃空军联训万里畅通,中东“开绿灯”成亮点
 Press release
·Jharkhand News: कालेज और पालीटेक्निक के अनुबंध शिक्षकों की नियमित नियुक्ति में आया बड़ा अपडेट, कहां-कहां मिलेगी छूट- मंत्री ने दी जानकारी
·India conveys opposition on pro Khalistan referendum to Canada
·福建海事局启动防台风二级应急响应,多条航线停运停航
·股票开户选择哪个证券公司比较好?2026普通人精准选券攻略
·以“智”提“质” 上好冬季运行“安全课”
 Collection of municipal and local releases
·美国政府停摆下的另类经济信号
·鸿蒙智行尚界 Z7 Allroad 车型首曝,预计下半年正式亮相
·记者:预计佩林转会巴勒莫今日官宣,合同期至2029年
·高温雨季来袭!福彩站点&彩票保管安全指南请收好
·直面停水催费、质价失衡、电梯隐患 杭州“公述民评”问政小区物业难啃的“硬骨头”

 

Copyright © 2020-2099 娱乐百分百 All Rights Reserved 娱乐百分百 Copyright