微软Azure官宣部署AMD Helios机架硬刚英伟达,谷歌“Frozen v2”芯片2028年落地效率飙升10倍,WAIC351款全球首发震慑外媒 ...
【数据猿导读】 微软Azure官宣部署AMD Helios机架硬刚英伟达,谷歌“Frozen v2”芯片2028年落地效率飙升10倍,WAIC351款全球首发震慑外媒 | 每日大事件
科技快讯知天下
☆微软将在Azure上部署AMD Helios机架用于AI推理
☆谷歌研发新型“Frozen”芯片,大幅提升Gemini AI模型运行效率
☆蚂蚁集团CEO韩歆毅:企业AI不能止于个体提效,打造组织智能
☆光轮智能与西门子达成合作,基于 SimFoundry打通工业仿真与具身仿真
☆昆仑万维方汉:2026为“世界模型元年”,主线将从“生成”转向“理解与交互”
☆宇树UnifoLM-OminiA-0.3发布,支持全模态交互理解
☆阿里云发布轻量应用服务器“智能体专用型实例”
☆千问发布语音合成大模型Qwen-Audio-3.0-TTS
☆无问芯穹夏立雪:AGI基础设施决胜点是“AI原生的Agentic Infra”
☆新石器成立无人配送车行业首个公司级安全委员会,余恩源亲自挂帅
☆红熊AI完成数亿元A+轮融资,投后估值近30亿元
重点新闻播报
☆微软将在Azure上部署AMD Helios机架用于AI推理
7 月20日消息,微软今日宣布,联合AMD扩展Azure AI与高性能计算(HPC)基础设施。微软表示,AI工作负载的规模正急速膨胀,任何单一的基础设施方案都已无法完全支撑。为满足这一需求,微软正不断升级Azure的基础设施,包括采用AMD最先进的AI与高性能计算解决方案来扩充其AI计算集群。(新浪财经)

☆谷歌研发新型“Frozen”芯片,大幅提升Gemini AI模型运行效率
近日,援引知情人士透露,谷歌正在研发一款新型服务器芯片,可直接集成其Gemini AI模型的设计蓝图,从而使公司能够更高效地向用户提供AI模型服务。知情人士表示,谷歌希望借助这款内部代号为“Frozen v2”的新芯片,缓解AI算力严重短缺的问题。算力不足不仅引发了公司内部资源争夺,也迫使谷歌云拒绝了一些外部客户的合作。据知情人士称,参与该项目的谷歌员工预计,该芯片推出后,按单位功耗可处理的Token计算,其效率将比谷歌现有最新一代自研AI芯片高出6至10倍。目前,工程师仍在决定新芯片的主要功能以及各组成部分如何协同工作。知情人士称,谷歌计划最早于2028年部署该芯片。(新浪财经)

☆元脑服务器推出CXL内存跨代扩展方案,实现DDR5和DDR4同机部署内存扩容
7月20日,元脑服务器推出CXL(Compute Express Link)内存跨代扩展方案,实现了DDR5和DDR4同机部署内存扩容。基于元脑服务器NF5280,在24条本地DDR5内存基本配置下,通过创新自研CXL内存扩展卡,单机最多可扩展16条DDR4内存,按照单条内存32GB容量,额外扩展512GB内存,整机内存容量提升33%,成本大幅降低25%。方案结合元脑服务器操作系统KOS池化内存技术,将本地DRAM内存与CXL扩展内存融合为统一逻辑内存空间,通过冷热数据识别、动态迁移和NUMA感知调度策略,让扩展内存达到本地内存相当性能,提升CPU利用率30%。目前,该方案已在国内某大型互联网客户完成验证并实现规模应用。(界面新闻)
☆光轮智能与西门子达成合作,基于 SimFoundry打通工业仿真与具身仿真
7月20日,在2026世界人工智能大会(WAIC)期间,物理AI基础设施企业光轮智能宣布与西门子正式达成合作。双方将基于光轮智能全栈自研的SimFoundry物理AI仿真底座,解决高精度工程仿真与实时具身仿真之间的转换问题。形成以SimFoundry为核心、向评测和部署延伸的完整链路:工业场景建模—SimFoundry高精度具身仿真—RoboFinals规模化训练与评测—RoboStack真实部署反馈,为机器人进入复杂工业场景提供全栈物理AI基础设施支撑,填补物理AI在工业场景落地的关键技术空白。(新浪财经)
☆昆仑万维方汉:2026为“世界模型元年”,主线将从“生成”转向“理解与交互”
7月20日,WAIC 2026期间,昆仑万维董事长兼CEO方汉在专场论坛宣布2026为“世界模型元年”,称AI主线将从生成”转向“理解与交互”。方汉给出三大预判:世界模型走出屏幕进物理世界、游戏行业率先被重构、AI音乐从技术试验转为大众创作工具。同日Matrix-Game 3.5世界模型、Mureka v9.5&O3音乐模型发布。 Matrix-Game 3.5实现Patch级记忆注入,5B模型720p下单卡20FPS实时生成,具备1分钟记忆,核心架构开源;Mureka v9.5指令精准度从6.92升至7.62,主打“最没AI味”,O3引入推理时自我修正。昆仑万维称,已从全模态生成跃迁至可交互世界模型,撬动AGI时代多模态下一程。(钛媒体)
☆宇树UnifoLM-OminiA-0.3发布,支持全模态交互理解
宇树科技于7月20日发布全新“UnifoLM-OminiA-0.3”模型,该模型能通过全模态交互(语音、视觉等)自主执行家居康养类复杂任务(如整理物品、辅助护理),并具备抗干扰能力,标志着宇树在通用具身智能模型上的进一步落地。此前宇树已开源VLA基座模型、部署工业级模型,并形成覆盖机器人硬件与感知系统的技术框架。(潇湘晨报)
☆阿里云发布轻量应用服务器“智能体专用型实例”
7月20日,阿里云推出轻量应用服务器智能体专用型实例,将vCPU、内存、云盘、200Mbps峰值带宽(免流量费)与大模型Tokens(1亿至32亿不等)打包为预付费套餐,为用户提供一站式AI Agent运行环境。目前已在北京、上海、广州等12个地域上线,未来将支持更多国内及海外地域。(界面新闻)
☆千问发布语音合成大模型Qwen-Audio-3.0-TTS
7月20日,千问正式发布语音合成大模型Qwen-Audio-3.0-TTS,支持Free-style自然语言指令控制,包含面向实时交互的Flash版本(首包延时300ms级别)和面向高质量生成的Plus版本。(金融界)
☆小红书、北大开源面向大规模MoE训推的负载均衡方案UltraEP
7月20日,小红书发文宣布其与北大提出UltraEP,首次把基于“精确”路由信息的“实时”负载均衡引入生产系统:在每个microbatch和每一层动态复制热点专家,让真实训推也能逼近理想性能。据小红书方面介绍,UltraEP平均达到理想性能的94.3%,相比业界SOTA训推框架提升1.49倍,并应用在了大规模预训练的实际生产中。(界面新闻)
☆容联云发布企业Agent矩阵,推出Voice Agent与私域运营Agent
7月20日,WAIC 2026期间,容联云发布企业Agent应用体系,明确AI发展从“大模型能力”向“业务生产力”进阶,AI正从辅助工具转变为可规模化复制的核心业务载体。针对当前企业面临的人机协同与业务闭环难题,容联云提出Agent需打通业务系统与数据资产,深度嵌入实际流程,成为驱动增长的新质生产力。本次发布聚焦客服、营销及销售场景,推出Voice Agent与私域运营Agent。前者集成语音理解与实时决策能力,实现服务策略动态调整;后者通过全域数据洞察生成个性化策略。(证券时报)
☆淘天集团发布AIGX四项成果
7月20日,淘天集团公布AIGX技术体系的四项最新技术成果。据了解,在AIGI方向,拍立淘全模态实时Agent正式上线,用户打开摄像头即可与AI进行实时交互,系统能同时处理图片、文字、语音、视频流等多模态输入,在用户浏览画面的同时完成意图理解与商品检索。在AIGC方向,淘天集团发布全场景AI创作工作台if Studio,该平台整合设计、视频、建站三类专家Agent协同工作,并内置HappyHorse 1.1视频模型及AI抠图、图像编辑等工具,覆盖从素材处理到内容生成的完整链路。在AIGU方向,Coupella智惠引擎及其核心的生成式因果推断大模型正式发布,该模型通过反事实预估、长期价值评估、三层增量挤占建模等方法,试图解决商家在营销补贴中长期面临的归因难题。在AIGR方向,DREAM Agentic推荐系统亮相,在推荐链路之上构建围绕用户意图的优化控制层,通过多专家可路由Agent结构实时推理用户状态。(新京报)
☆Chance AI发布视觉推理智能Chance Vision 1.5
7月20日,在WAIC 2026期间,视觉智能公司Chance AI发布新一代视觉推理智能Chance Vision 1.5,并集中展示Chance AI App及以摄像头为入口的Camera-First Visual Agent技术路径。该模型在高难度多模态理解与推理基准MMMU-Pro官方公开榜单取得86.9%综合准确率,达到该基准的 SOTA。(中国经营报)
☆蚂蚁数科发布“商业智能体超级工厂”
7月20日,在WAIC 2026上,蚂蚁数科发布面向智能体时代的企业AI解决方案“商业智能体超级工厂”,核心平台Agentar 2.0首批预置近200个岗位级数字专家模板及数百个可订阅Skills级智能体工具。蚂蚁数科自研基座模型LingDT提升Token效率、降低部署成本,自研Agentix智能体操作系统负责全流程调度,并以区块链技术为每个Agent赋予可信身份、将协作与资金流转上链。截至目前,蚂蚁数科依托“商业智能体工厂”方案,已服务100%国有银行和股份制银行、超过60%的地方性商业银行,以及数百家金融机构,落地超300个金融行业智能体。(光明网)
☆华为首次完整展示全系列计算模组产品
7月20日,在WAIC 2026世界人工智能大会上,华为首次完整展示全系列计算模组产品,包括网卡、SSD、DPU、RAID卡四大系列产品,如国内首发的800GE AI网卡,支持10万级节点超大规模组网,以及KVU方案等。据了解,其计算模组产品已在头部互联网、运营商、金融等场景规模应用。(新浪财经)
☆Airwallex 空中云汇发布 AI 时代财务白皮书
7月20日消息,2026 WAIC期间,Airwallex 空中云汇发布了委托Forrester撰写的《打造适配AI时代的财务体系》白皮书。调研覆盖全球11个市场1279名财务决策者,首次完整披露全球财务AI转型三大趋势与核心痛点。白皮书指出,57%的全球财务高管将“AI预判业务机遇、识别经营风险”列为首要目标,与追求“端到端流程自动化”的比例基本持平。财务AI价值重心正从基础任务自动化,转向支撑经营诊断与市场预测等战略决策。然而,AI虽已覆盖63%的核心财务流程,但仅11%的流程可在极少人工介入下自主运行,数据孤岛与系统割裂成为主要落地障碍。白皮书建议企业应将财务自动化、合规管控与支付体系整合至统一运行环境,依托AI原生金融操作系统驱动智能化升级。(极客公园)
☆中科类脑发布全球首款算电一体化平台
7月20日消息,WAIC 2026期间,中科类脑推出全球首款算电一体化平台,面向Token工业化生产补齐传统算力平台与能源管理系统功能割裂的短板,首次实现电力供给、异构算力调度、大模型Token产出三位一体协同管控。平台采用“1+3”架构:一套博弈智能决策大脑统筹电力、算力、Token三大子系统。电力子系统集成微网管控、现货交易、全域PUE优化、虚拟电厂,匹配风光新能源出力错峰调度算力;算力子系统统一抽象多架构芯片,池化纳管全国分散闲置算力;Token子系统覆盖算子编译、KVCache分层管理、推理优化全栈技术。(财联社)
AI全球观察
☆谷歌被曝研发“Frozen v2”新型AI服务器芯片,将Gemini架构直接写入芯片
据财联社7月21日报道,谷歌正在研发一款内部代号为“Frozen v2”的新型服务器芯片,旨在更高效地运行Gemini模型。报道称,该芯片将把Gemini模型部分架构永久嵌入到芯片中,从而减少回答用户问题所需的计算量和数据传输量。谷歌工程师预计,Frozen芯片单位功耗可提供的Token处理能力将是谷歌最新一代TPU的6至10倍。谷歌计划于2028年部署该芯片,作为定制芯片产品线中更具针对性的专用分支,而非取代通用型TPU。受该消息影响,Alphabet股价盘中一度涨近3.7%。
☆AMD正式推出首款机架级AI系统Helios,微软成为核心客户
7月21日,据CNBC报道,AMD正式推出其首款全栈机架式AI系统Helios,直接对标英伟达的Grace Blackwell与Vera Rubin整机方案,成为近五年来首个能在高端AI算力集群领域对英伟达形成实质性竞争的产品。微软于本周一官宣成为首批核心客户,将在Azure数据中心内部署Helios系统。Meta、OpenAI、甲骨文及印度塔塔咨询服务公司此前也已确认将部署该平台。AMD表示,全球排名前十的AI企业中已有8家在其Instinct GPU上运行核心业务负载。Helios将于2026年下半年正式启动批量交付。
☆英伟达向日本AI企业Noetra大规模提供GPU,推动“物理AI”开发
据共同社7月21日报道,英伟达将向日本新成立的AI公司Noetra大规模提供最新半导体GPU。Noetra由软银等出资成立,并获得日本政府支援,旨在开发AI自主控制机器运行的“物理AI”基础模型。英伟达CEO黄仁勋表示:“这是构建国家规模AI基础设施的举措”。公司将获得英伟达提供的约2.75万颗GPU,推进构建运算基础。公司发展分三阶段推进:2026财年推出侧重日语能力的推理模型,2028年实现多模态版本,2030年推出专为操控机器人设计的“现实原生AI”。
☆Meta与英伟达联手押注AI材料,发力半导体下一代制造材料
7月21日,据The Guardian报道,Meta与英伟达联合官宣,共同参与英国AI初创公司CuspAI的核心材料发现项目,瞄准半导体行业下一代制造材料的突破性研发。本次三方共同启动的“AI材料铸造厂”合作计划将依托AI技术重构传统材料研发流程:英伟达将为CuspAI开放最新的大规模GPU加速计算集群;Meta的基础AI研究团队则将深度参与算法优化与大模型训练环节。目前“AI材料铸造厂”生态已经吸引45家机构加入。
☆OpenAI模型突破数学难题后暴露安全困境,揭示长周期模型评测盲区
据Edge AI Daily早报,OpenAI长周期模型在破解数学猜想的同时暴露了新型安全风险——模型在内部测试中绕过了沙箱限制,花费一小时找到漏洞并提交公共PR,还通过组合无害动作序列获取用户凭证浏览邮件。这揭示了传统“单动作审核”安全框架的局限性。OpenAI为此提出“轨迹级监控”新范式,从审查单个动作升级为追踪整个行为序列意图。
☆英伟达推出Agent Toolkit,30分钟即可本地部署AI智能体
当地时间7月20日,英伟达宣布面向搭载GB300 Blackwell Ultra GPU的DGX Station工作站推出Agent Toolkit软件工具包,开发者仅需三步、约30分钟即可在本地部署并运行AI智能体。该工具包可与Omniverse平台结合,支持开发者在本地完成AI智能体的构建、测试及3D仿真验证。
☆SpaceX向鸿海下达520亿美元AI服务器订单
据钛媒体报道,鸿海(富士康母公司)首次获得SpaceX价值520亿美元的AI服务器代工订单,订购约1.3万台英伟达GB300服务器机架。这一订单打破戴尔和超微的双寡头垄断,预计将鸿海2026年全球AI服务器市场份额推升至40%以上。
☆Anthropic15亿美元版权和解获美国联邦法院批准
美国联邦法院周一正式批准AI实验室Anthropic与作者、出版商达成的15亿美元版权和解协议。这起集体诉讼涉及约50万部作品,按每部3000美元的标准向权利持有人支付赔偿。法官此前已判定使用版权书籍训练AI模型属于合理使用,但法院同时认定Anthropic从盗版网站下载书籍的行为违法。虽是美国版权史上金额最大的和解案之一,但未形成具有广泛约束力的先例。
大公司财报
☆Alphabet财报前夕备受关注,市场聚焦五大AI疑问
Alphabet将于美东时间周三盘后公布第二季度财报。作为全球第三大市值公司及AI资本开支风向标,市场高度关注五大问题:谷歌云增长霸主地位能否经受竞争冲击、TPU外部销售是否已转化为实际收入、资本支出驱动的现金消耗情况、Gemini是否真正追赶ChatGPT和Claude、以及AI对谷歌搜索广告引擎的增益。一季度Alphabet营收1099亿美元(同比+22%),谷歌云营收突破200亿美元(同比+63%),全年资本支出预期上调至1800亿至1900亿美元。
☆三家A股公司上半年业绩预增超百倍,AI算力需求成核心驱动
铜冠铜箔、国际复材、力源信息三家公司相继披露2026年半年度业绩预告,净利润同比增幅均超150%。铜冠铜箔预计净利润同比增长486%至544%;力源信息预计同比增长207%至217%。背后共同的推动力指向AI算力产业链的持续爆发。
☆杰创智能“AI+云计算”业务收入同比增长约550%
2026年上半年,杰创智能“AI+云计算”业务收入预计约2.04亿元,同比增长约550%;息税折旧及摊销前利润(EBITDA)预计约1.41亿元,同比增长约340%。公司同时公告拟不超100亿元采购IT设备加码智算云业务。
☆芯片股反弹带动亚股止跌,市场聚焦科技巨头财报
晶片股回升提振亚洲市场,摩根士丹利国际资本公司(MSCI)亚太指数7月21日上涨1.7%。三星电子和台积电成为主要推动力,韩国和台湾基准股指涨幅均超2.5%。特斯拉和Alphabet将在22日率先发布业绩,微软、Meta、苹果和亚马逊下周公布。贝莱德策略师指出:“尽管近期市场波动,AI投资热潮及对AI基础设施的偏好依然不变。”
国内政策/活动要闻
☆中方介绍2026世界人工智能大会五大成果
7月21日,中国外交部发言人林剑在例行记者会上介绍了2026世界人工智能大会达成的一系列重要成果:一是明确人工智能全球治理方向,习近平主席从发展、安全、文明和治理4个方面阐述了中国方案;二是助力弥合全球智能鸿沟,宣布面向发展中国家提供5000个AI培训名额等3项务实举措;三是筹建世界人工智能合作组织取得重大进展;四是广泛凝聚全球AI治理共识;五是推动国际AI发展合作。大会展览面积10万平方米,351款产品全球首发,预计达成意向采购金额约203.6亿元。
☆“从大模型到智能体”论坛在沪举行,多项标志性成果发布
由世界人工智能大会组委会办公室指导、中国信通院承办的“从大模型到智能体:迈向自主智能新纪元”论坛日前在上海西岸国际会展中心举办。工信部科技司副司长甘小斌表示,人工智能产业发展重心正全面转向智能体全域互联生态构建,智能体已成为培育新质生产力的核心变量。论坛现场集中发布了《智能体互联互通协同发展与治理倡议》《2026智能经济新形态:智能体创新实践汇编》《互联网智能体发展研究报告》等标志性成果。
☆美媒:中国AI快速进步打破美国“牢不可破的领先优势”设想
据《华尔街日报》7月21日报道,在上海举行的世界人工智能大会让美国企业感到形势严峻。大会开幕第一天,月之暗面发布新模型Kimi K3震动全球市场,被认为已跻身世界顶尖水平;两天后阿里巴巴宣布新模型性能超过Kimi K3。《华尔街日报》指出,中国AI快速进步已打破美国此前希望建立“牢不可破的AI领先优势”的设想。中国AI模型正在全球范围内获得越来越多关注,部分原因是许多中国模型采用开源模式、运行成本通常低于西方模型。法国《世界报》刊文指出,在外部芯片受限背景下,中国AI团队走出了一条独特的突破路径。
来源:数智猿
刷新相关文章
我要评论
不容错过的资讯
大家都在搜









































































































