

一 | 7 月 21 日,外媒独家披露谷歌 Alphabet 内部代号 Frozen v2 的专用推理服务器芯片研发细节,这款芯片将 Gemini 底层模型架构直接固化至硅片,内部测试数据显示,它单位功耗下的 Token 处理效率达到现有顶级 TPU 的 6 至 10 倍,产品核心面向 AI 智能体高并发推理场景,计划 2028 年完成落地部署,消息流出后 Alphabet 盘中股价涨幅突破 3%。 当前市场主流 GPU、TPU 均为通用可编程架构,能够适配各类大模型运行,但在实际工作过程中需要持续调度运算资源、频繁迁移内存数据,而 AI 智能体需要不间断生成文本、高频调取缓存信息,长期运行下会产生严重的功耗损耗与延迟问题,也就是行业普遍存在的内存墙难题。 央视网消息:据“今日平江”微信公众号消息,4月23日,湖南平江县发布关于该县一学生坠亡事件调查情况通报。 4月15日,平江县天岳街道一居民楼发生学生坠楼事件,坠楼学生经抢救不幸身亡,令人无比痛心和惋惜。事发后,平江县迅速成立由县委政法委、县公安局、县教育局和有关属地乡镇(街道)组成的联合调查组,全力开展调查和善后处置工作。Frozen v2 走出了完全不同的设计思路,研发团队没有把完整模型权重固定在硬件内部,而是将 Gemini 体系中复用频率最高的底层决策、解码运算通路蚀刻进芯片电路,从硬件层面削减运行过程中的计算步骤与数据传输消耗。这款芯片将每瓦可处理 Token 数量作为核心评估指标,而非单纯追求纸面峰值算力,天然适配智能体长上下文交互、全天候持续推理的负载需求,同时研发团队仅锁定标准化模型运算架构,保留权重迭代更新的空间,弥补初代 Frozen 完全固化模型、芯片使用周期过短的短板。现将有关调查情况通报如下: 一、事件基本情况 2024年4月15日7时46分,平江县公安局三阳派出所接到电话报警,天岳街道简青社区大众安置区某居民楼有一小孩坠楼。从产品定位来看,Frozen v2 并不会取代第八代 TPU 承担训练与通用推理工作,谷歌由此形成双轨芯片布局,TPU 负责承接外部云客户多样化模型需求,Frozen v2 则专供内部 Gemini 大模型、各类智能体、搜索以及办公软件等高负载业务,二者形成互补搭配。 本届 WAIC 已经释放清晰产业信号,AI 行业正式进入智能体规模化落地阶段,海量 Agent 多任务自主调度、云端高并发推理成为算力消耗的主要来源,这也是谷歌全力推进 Frozen v2 研发的核心动因。面向企业级智能体与 C 端终端配套云端服务,芯片能够同时承载上万条长文本指令,持续输出多轮交互内容,依靠低功耗特性大幅压缩集群供电与散热开支;谷歌自有搜索智能助手、办公智能体、多模态交互产品的推理调用量持续攀升,现有算力供给缺口已经迫使谷歌云暂缓承接部分外部订单,专用推理芯片落地后可以快速补足内部算力短板。接警后,三阳派出所民警立即出警处置,120急救中心第一时间赶到现场将该小孩送往医院抢救,经全力抢救无效于10时30分宣布死亡。经查明,坠楼小孩杨某,男,汉族,9岁,系平江县简青芙蓉学校学生,其母亲租住在学校附近大众安置区陪读,其父亲在外务工。同时智能体执行跨平台、多步骤复杂任务时高度依赖大容量上下文缓存,Frozen v2 在硬件层面优化内存读写链路,有效减少缓存反复搬运带来的多余功耗,进一步降低智能体长期运行的综合成本。 二、现场调查情况 经公安机关现场勘查、调查取证、法医检验,确定学生杨某死因排除他杀。楼顶监控显示:2024年4月15日7时32分,杨某独自步行至大众安置区其租住楼楼顶,身着校服、系红领巾、背蓝色书包,到达楼顶后先是步行至东侧围栏,脱下书包置于地面,从口袋中掏出零食吃,随后两次在楼顶走动、攀爬和停留。 Frozen v2 研发消息曝光,意味着全球 AI 芯片赛道分化出两条清晰发展路径,行业算力竞争的重心,也从单纯比拼峰值算力,转向推理能效、单 Token 运行成本的长期较量。英伟达与 AMD 坚持通用算力发展路线,旗下 GPU 与整机柜方案兼顾训练、推理全场景需求,生态体系成熟完善,但在智能体高频推理场景下能效表现存在明显短板;谷歌选择模型深度定制芯片路线,Frozen v2 与自家大模型深度协同设计,最大限度压低推理单位成本,缺点是通用性有限,仅能适配 Gemini 产品体系。除此之外,SambaNova、d-Matrix 以及国内多款专用推理芯片都在推进模型与硬件深度耦合的研发方向,行业逐渐形成统一共识,训练环节依旧依靠通用算力集群支撑,而大规模商业化推理场景,会逐步走向专用化定制芯片。 这款芯片依旧存在不少短期落地约束,目前整体还停留在架构设计阶段,最快要到 2028 年才能小规模投入使用,距离全面商业化还有两年多时间,短期内无法缓解全球当下的算力紧缺现状。同时产品适配范围存在明显局限,仅能对接 Gemini 系列大模型,无法对外提供通用算力租赁服务,很难复刻 TPU 对外云业务带来的营收增量,并且芯片硬件固化的模型逻辑范围仍在持续调整,研发团队需要不断平衡运算效率与模型迭代灵活性,不排除项目中途调整规划、缩减量产规模的可能性,谷歌官方也对外表示,内部研发项目不代表最终都会量产落地。7时37分,当杨某第三次从中部隔离栏攀爬后,从监控中消失。拉长周期来看,Frozen v2 的落地会带来深远产业变革,若 6 至 10 倍的能效提升能够实现量产兑现,AI 智能体、大模型云端服务的单 Token 运行成本将显著下降,进一步推动 C 端、B 端智能体产品普及。 三、学校应对情况 2024年4月15日上午7时58分,该生所在班级班主任李某发现学生杨某未到学校,遂打电话询问其母亲单某。单某在通话中哭泣提到,孩子坠楼送医。

二 | 获悉情况后,班主任李某立即报告学校,校长朱某、安保专干毛某迅速赶到出事地点,后又赶往医院,积极协助抢救、善后等工作。 四、网友关注的具体问题调查情况 事情发生后,有网友在网上转发相关视频,高度关注“老师罚抄一万遍”“打手心”两个具体问题,联合调查组进行了调查核实。谷歌这套模型与芯片底层协同设计的方案得到验证后,各大头部大模型厂商都会加速自研专用推理芯片,通用 GPU 在推理市场的份额会持续承压,行业整体算力投入逻辑也会发生转变,过去厂商资源集中投向训练集群,未来资本开支会持续向推理专用硬件倾斜,匹配 AI 产业从技术训练走向商业化落地的周期切换。 Frozen v2 是谷歌为解决 AI 智能体推理算力瓶颈推出的战略性产品,跳出传统通用 TPU 的设计框架,以牺牲通用适配能力换取极致运行能效,精准贴合当下全球 AI 产业告别参数内卷、全面推进智能体工业化落地的核心趋势。 1、关于“老师罚抄一万遍”的问题。据调查,该班数学老师陈某在2023年下学期期末复习时,多次讲解“分级”知识点,但课堂检测时杨某等7名同学未按要求掌握。陈某于是在班上讲,“既然讲了这么多次还不知道怎么做,就抄写‘分级’两个字,抄写一遍两遍不记得,就抄一百遍,抄一百遍不记得,就抄一千遍,抄一千遍还不记得,抄一万遍总会记得”。短期来看,芯片落地周期漫长,无法立刻改变全球算力竞争格局,长期视角下,该项目印证软硬一体化定制是推理赛道的核心突破方向,也会倒逼英伟达、AMD 加快迭代推理专用芯片,整个 AI 算力行业的竞争主线,正式从训练算力比拼,转向智能体推理能效的持续对抗。陈某要求相关学生每天抄写200遍(400字),因临近寒假,并未检查学生抄写情况。春季开学后,2024年2月26日开始由班干部检查抄写情况,陈某不定期抽查。3月29日,陈某认为这些学生对该知识点基本掌握,并且认为方法也欠妥,在班上明确罚抄不再继续。经核查,杨某在作业本上共抄写“分级”两个字21个单页。 2、关于“打手心”的问题。

三 | 据调查,为加强班级管理,该班科任老师在2023年下学期开学时和全班学生进行约定,如果不能按要求完成学习任务,可采取“打手心”(使用一根缠有胶布、长37厘米、重27克的竹条敲打手心)的方式进行惩戒,同时要求全体学生回家后征求家长意见。之后,科任老师在课堂上逐个询问学生是否告诉家长,家长是否同意。有2名学生反馈家长不同意,包括杨某在内的其他学生反馈家长未提出反对意见。

四 | 9月6日开始,科任老师对未按要求完成作业的学生(2名家长持反对意见的学生除外)采取了“打手心”的方式进行惩戒。调查中家长反映,“打手心”后老师会不定期与他们进行沟通。今年3月14日,杨某母亲通过微信与班主任老师交流,说孩子在家不想做作业,想蒙混过关,家长管教又不听,希望老师多帮助教育。3月20日至4月15日,共有184人次学生在21节课堂上,因未按要求完成学习任务被“打手心”,其中杨某被“打手心”8次。 另据调查,本学期开学以来,学生杨某在校期间表现无异常情况。 目前,联合调查组已将调查情况移交县纪检监察部门,由纪检监察部门依规依纪对相关人员进行处理。
Current article:http://1k9qfoi.recuigoutoubaozukai.pics/list_qh6m1u/ywo03p7.html
Published on:07:11:33
上海滩_Random reading
全城热恋_Active users
小三_Hottest this week