
一 | 1 这两天酒店圈有个大事。

二 | 闻乐 发自 凹非寺 量子位 | 公众号 QbitAI 如果把AI芯片比作发动机,那AI软件栈就是「变速箱+传动系统+驾驶系统」。 发动机再猛,传动拉了胯,动力传不到车轮上,车照样跑不起来。 文华东方,就是那个住一晚能顶很多人一个月工资的奢牌酒店,被母公司怡和集团用42亿美元打包带走,从新加坡股市私有化退市了。 这个道理,做了8年芯片的平头哥比谁都清楚。 顺便还把自己在香港铜锣湾“港岛壹号中心”最顶13层楼面,卖给了阿里巴巴,套现9.25亿美元。 WAIC 2026现场,阿里平头哥宣布开源自研AI软件栈T-Head SAIL。 这是其真武系列AI芯片的底层软件,拥有独立的自主知识产权,同时全面兼容主流AI生态,覆盖从OS层、SDK层到接口层的完整链路。 源码、驱动、工具链、文档一次性摆上桌,全球开发者都可以在平头哥开发者社区下载。 而在开源之前,这套软件栈已经攒下了一份相当能打的成绩单。 一边退市,一边卖楼。 朋友圈立马分成了两派。 一拨人觉得这步棋走得妙: 彻底摆脱股市的绑架,不用再为了每个季度的财报当孙子,可以安心搞品牌、做长期战略了。 另一拨人觉得文华东方这就是混不下去了: 明明就是股价长期半死不活,盈利能力被同行吊打,上市混不下去才被迫退市,这就是战略收缩。 那么问题来了,文华东方这波操作,到底是“资本妙棋”,还是“无奈之举”? 坦率说,挺文华东方的这批人共情能力挺强的,也确实懂上市公司的无奈。 截至今年4月,真武AI芯片累计出货56万片,服务20多个行业的400多家客户。

三 | 还在阿里云以及大量行业企业的真实生产环境里跑了很久,扛过双11级别的大规模流量洪峰,也扛过复杂场景和严苛SLA的反复拷问。 也就是说,平头哥这次拿出来的是自家业务的核心底盘。 所以问题来了,一家芯片公司,为什么要主动拆掉自己的围墙? AI芯片的胜负手,从来不在硬件 要理解这个动作的分量,首先得理解软件栈在AI算力链条中有多关键。 一颗芯片刚从产线上造出来的时候,对开发者来说其实是不可用的。 开发者日常写代码用的是PyTorch、TensorFlow这些上层框架,他们不会,也不应该直接去跟芯片底层的电路和指令集打交道。

四 | 你以为上市之后的自己是霸道总裁。 这中间必须有一整套完整的基础设施来做翻译和调度,把开发者用Python写的几行代码拆解成成千上万条芯片能高效执行的底层指令。

五 | 这个桥梁就是AI软件栈。 作者声明:该图片由AI生成△图片AI生成 用户能看到的只是水面之上的API接口,水面之下是厚厚的算子库、编译器、运行时、驱动层,以及围绕这些核心组件的调试工具和性能分析套件。 其实是天天被一帮华尔街之狼围着,每个季度问你:“这季度挣了多少钱?下季度能挣更多吗?不能?那你是不是不行了?” 文华东方就这处境。 只有配合足够强大的软件栈,才可能充分发挥出芯片的算力性能。 退市之后相当于耳根子清静了。 然而,现实中的门槛还要更高一层。过去很长一段时间里,AI软件栈对大多数开发者来说都是一个典型的黑盒。

六 | 2 首先,最直观的一点,它终于不用再“quarterly交作业”了。 作者声明:该图片由AI生成△图片AI生成 芯片厂商交付的是一套编译好的二进制工具链,你只能按照文档给定的方式调用,既看不到内部实现逻辑,也不知道芯片在底层到底怎么跑你的模型。 所以一旦遇到性能瓶颈或者兼容性问题,开发者只能提工单等厂商响应。

七 | 一个模型迁移项目,动辄要花数周甚至一两个月的时间来回调试,而在这个时间里,模型版本可能已经迭代了两三轮。 时间成本之外,开销成本也足以让人打退堂鼓。 你想想,上市公司像个啥? 就像个被24小时直播的网红,还要每个季度都得在股东、分析师面前搞一次“业绩汇报直播”。 这也解释了为什么NVIDIA能在AI算力市场上稳坐接近十年。 靠的不只是哪一代GPU的纸面参数,更是护城河CUDA。

八 | 管理层至少30%的精力,不是花在怎么把酒店服务做得更牛逼上,而是耗在: 哄股东开心 把财报做得漂亮 应付没完没了的审计和合规 这感觉,就像你是个想潜心搞创作的科学家,但有个“事精”天天站你身后,每天换着花样给你搞事情,你还哪有时间和心思去搞那些十年后才能出成果的尖端研究? 文华东方这一退,从精神状态上先解套了。 其次,它可以安心搞“品牌建设”这种慢功夫了。

九 | 开发者十几年积累下来的开发习惯、代码资产、社区经验和工具生态,构成了一道比制程更难跨越的墙。 讲个故事。 2019年的时候,文华东方想花5000万欧元翻新巴黎酒店,股东问:“多久回本?”答:“7到10年。”股东脸都绿了。 而CUDA之于NVIDIA,就相当于SAIL之于平头哥。 现在,平头哥决定把这个局面彻底翻转过来,SAIL开源就是主动替开发者拆掉那道墙,把原本黑盒的底层能力,变成了透明可控的白盒。 你品,你细品。奢华品牌的建设,本来就是慢工出细活。

十 | 软件栈开源后,过去只有头部云客户才能接触到的底层能力,现在对任何一个研究团队、任何一个开发者都是敞开的。你非要它两三年回本,那不就等于逼着故宫搞快餐? 私有化之后,它就能: 大胆翻新,不怕股东骂 专注“低调奢华”,不被利润绑架 投资员工培训、文化体验,不砍成本 保持“慢而美”的节奏,不盲目扩张 这个东西有作业可抄的。 用户可以读源码真正搞清楚芯片的运行逻辑;遇到bug能自己定位甚至直接动手修复; 更进一步,还可以针对自己的业务场景做深度定制优化,毕竟没有人比开发者自己更了解自己的负载长什么样。 平头哥SAIL一开源,开发者的开发效率和技术自主性都同时迈上了一个新的台阶。

十一 | 你看四季酒店,2007年私有化之后,反而迎来了黄金期——不卷规模,卷品质,房价一路涨。

十二 | 最后,它可以“灵活卖楼,轻装上阵”。

十三 | 无需重写、无需等待、无需绑定 细说平头哥这次开源,对外开放的是一套经过生产环境验证的五层完整技术栈,从最底下的驱动一直堆到最上面的运维工具。 最底层是驱动和运行时(Driver & Runtime),这层决定了操作系统能不能识别真武芯片、能不能把计算任务正确地调度下去。 这两年文华东方虽然一直在“卖卖卖”: 但其实一直是“卖楼不卖牌”,做的是从“房东”到“管家”的转型。

十四 | PPU Runtime负责管理设备内存、命令队列和计算上下文。 PPU Driver分为用户态驱动(UMD)和内核态驱动(KMD),配合PPU Runtime对外提供统一的设备管理和内存管理接口。 比如,卖掉了巴塞罗那酒店物业,却保留管理权。 卖掉了巴黎酒店物业,但签了50年管理合同。

十五 | 这一层是芯片和操作系统握手的地方,也是过去最不透明、开发者最摸不着的地方。

十六 | 这套驱动和运行时的设计,是真武芯片能够在大规模集群里稳定运行的基础。 显而易见,这是战略调整。

十七 | 往上是编程语言层,开放了C/C++和Python接口。但你是上市公司,以前卖个楼文华东方可能要解释一大堆,而且就算解释的再清楚,也会有人跳出来说“不听不听,王八念经”。 私有化之后,它明显更灵活。 看起来是个简单的设计选择,但背后隐含着一个关键判断: 不让开发者为一颗芯片去学新语言、换编程范式,而是与主流生态对齐,让现有代码资产平滑迁移。 再往上是编译器层,包含Compiler与Debugger两大组件,支持从模型图到可执行代码的端到端编译优化。 对开发者来说,这意味着可以看到编译过程中每一步的中间表示,理解模型在具体场景里是怎么被优化的。 第四层是高性能库,SAIL技术栈里最厚的一块。卖楼?老子乐意怎么卖就怎么卖!资产调整速度更快,资金想投哪儿投哪儿。 计算库涵盖线性代数加速库acBLAS、快速傅立叶变换库acFFT、随机数生成库acRAND、稀疏矩阵加速库acSPARSE、深度神经网络加速库acDNN、求解器acSOLVER等全套数学和AI基础库。 这不是没有参考案例。 你看希尔顿,2007年私有化后一顿操作,卖掉重资产,专注品牌管理。

十八 | 这些库的每一行代码,都针对真武芯片的底层架构做了精细优化,确保常用的AI计算操作能以最高的效率执行。

十九 | 编解码库包含编码HGENC、解码HGDEC、JPEG编解码HGJPEG与预处理HGPP等,对应多模态数据处理的高吞吐需求; 集合通信库PCCL与sailSHMEM,专为多卡、多机分布式训练设计,冲的是大规模训练里的通信瓶颈。

| 2013年重新上市,估值翻倍。 此外还配备了acext扩展库与HGML机器学习库,继续拓宽功能边界。

| 最顶层是开发工具层,Asight Compute做算子级的精细性能分析,用来定位微观瓶颈;Asight Systems做系统级全栈Profiling,提供宏观视角; PPU-SMI负责设备的实时监控与管理;PPU-DCGM则支撑集群级别的资源智能调度。 单卡上抠算子性能,千卡集群上盯资源调度,两头都有称手的工具。 3 这些问题虽然都客观存在,但也不能说唱衰文华东方私有化的人就完全没有道理。 不过对绝大多数开发者来说,比「全」更要紧的是「迁移成本」,平头哥给出的答案是三个无需妥协。 人家也有自己的一套逻辑。 首先是无需重写代码。 第一,文华东方这些年股价表现确实一般。 SAIL兼容主流AI生态,主流模型即开即用,算子库完整对标,主流编程模型高度兼容。

| 股价从2015年的2.8美元,跌到2024年私有化前的1.8美元,十年跌了36%。

| 同期,恒生指数没咋动,奢侈品指数还涨了50%。 你说这是市值被“低估”?还是市场真不看好? 而且从总估值倒推文华东方的单房估值,与同级别品牌对比也比较惨: 四季:2000万美元/间 凯悦:1200万美元/间 文华东方:955万美元/间 第二,盈利能力拉胯,利润不行。 2023年,文华东方的净利润率是5.8%。

| 开发者过去积累的经验、写下的代码、攒下的调优技巧在SAIL上都能直接复用。

| 四季是12%-15%。 为啥?文华东方成本高、房间少、扩张慢、数字化落后… 你说你品牌牛逼,但酒店是生意,不是慈善。 其次是无需等待适配。 AI技术的迭代速度有多快不用多说,一个新模型出来,社区的适配往往是以天计的。 SAIL这边,平头哥自研的推理引擎提供开箱即用的生产级性能,同时已经建立起与主流社区同频的响应机制。不赚钱,你说啥都没用。 第三,竞争卷成麻花,它还在慢悠悠。 目前对主流AI推理框架的平均适配时间小于7天。

| 这个速度基本意味着,社区那边的热度还没过去,开发者在真武芯片上就已经能跑了。 而且无需自己额外做适配和调优,就能用上最新的算子、特性与优化手段。 就看门店规模,目前四季酒店120家,丽思卡尔顿100+,柏悦60+。文华东方?44家。 最后是无需绑定框架平台。 SAIL已经全面适配PyTorch、TensorFlow、vLLM、SGLang等260余个主流训练与推理框架,工具链也支持按需灵活选用,不绑定任何特定技术路线。 这一条其实最见格局,SAIL明确把技术选型的自主权留给开发者,开发者也不必担心被锁死在某个封闭生态里。

| 新来的安缦、六善、宝格丽,一个比一个狠,要么极致奢华,要么健康养生,要么奢侈品跨界。 文华东方呢?扩张慢、品牌老、App刚出、会员计划没人理。 不重写、不等待、不绑定,用开放换取信任,用兼容降低门槛,T-Head SAIL把迁移的摩擦力尽可能降到了“零”。 你说你要“专注长期”?市场会等你吗?不会。

| 4、所以,文华东方私有化的真相是啥? 很明显,它既不是完全主动的战略升级,也不是完全被动的战略收缩,而是“在没办法中想办法”。

| 即“被动”又“主动”。 对!就是这么尴尬。 被动的是:股价低、利润差、竞争卷,都是事实。 平头哥的全栈牌局 其实再把视线拉远一点会发现,SAIL开源是平头哥8年布局走到今天的一个必然节点。 2018年,平头哥成立时AI芯片赛道已经挤满了玩家,外界对它的初始印象大抵是“阿里内部的一个芯片孵化项目”。 但平头哥在阿里内部的待遇从来不普通,芯片这块最难啃的骨头一直享受着饱和式投入的待遇。

| 主动的是:它选择了私有化、选择了轻资产、选择了聚焦长期。 它不是在躺平,它是在换装备,在挣扎。 高强度的研发投入,加上与阿里云、大模型等核心部门的紧密协同,让平头哥以一种闷声干大事的节奏,成长为中国芯片产业链里最大的黑马。 2019年,成立仅一年的平头哥推出第一颗芯片含光800。 这是一颗针对AI推理场景深度定制的芯片,采用自研架构、推理性能达到78563 IPS,也就是每秒可处理7万8千张图片,一举拿下当时同类芯片性能与能效比的两项第一。 接下来的3-5年,对文华东方来说是生死时速的“转型黄金窗口”。 随后含光800逐步应用于双11淘宝主搜场景,在真实流量中完成检验。窗口期一过,是骡子是马,溜都没得溜。

| 而在这个窗口期内,其实只看三点。

| 紧接着,平头哥把目标投向了难度更高、通用性更强的CPU赛道。 2021年云栖大会上,倚天710正式亮相,这是阿里体系内第一颗通用服务器CPU。 第一,看它能不能真正“轻装上阵”。 阿里由此成为首家具备CPU研发设计能力的中国互联网公司。 这颗芯片性能超过同期业界标杆20%,能效比提升超过50%,如今已通过阿里云大规模应用于视频编解码、高性能计算、游戏等领域。 而在通用AI芯片这条最考验综合能力的主跑道上,平头哥的步伐同样扎实。 现在文华东方大概30%的酒店是纯管理,目标是干到60%以上。 真武810早在2022年底、2023年初就已经完成了研发和场景验证。

| 它采用并行计算架构和片间互联技术,配备96GB HBM2e内存和700GB/s片间互联带宽,支持PCIe 5.0×16接口,功耗控制在400W,配合全栈自研软件栈实现了从硬件到软件的完整自主可控。这意味着啥?意味着它得从自己吭哧吭哧当“包租婆”,变成靠品牌和管理费吃饭的“超级管家”。 阿里已将其大规模用于千问大模型的训练和推理,外部客户也将其部署在各种AI推理和训练的产线上。 到了今年的2026阿里云峰会,平头哥亮出了新一代训推一体AI芯片真武M890。 这颗芯片内置144GB显存,片间互联带宽提升到800GB/s,整体性能是真武810E的3倍。 成了:资产负债率下降,财报立马好看,现金流更健康。 不成:还是背着沉重的资产包袱,那就等于换汤不换药,私不私有化没啥区别。 更重要的是,M890原生支持从FP32高精度训练到FP4低精度推理的全场景覆盖。 再加上自研的ICN Switch 1.0芯片,可实现64卡全带宽互联,显著提升大规模智算集群的计算效率与稳定性。 到这里,平头哥的芯片版图已经非常清晰了。 算力维度,有真武系列AI芯片和倚天系列Arm服务器CPU,一个打AI,一个打通用计算。 网力维度,有ICN Switch互联芯片和磐脉系列智能网卡,负责大规模集群内部的高速数据交换。 存力维度,有镇岳系列存储主控芯片,例如对标业界标杆三星旗舰的SSD主控芯片镇岳510,满足AI训练推理对低延时、高带宽存储的需求。 第二,看它能不能把规模做大。 说实话,文华东方现在一年开2-3家,跟蜗牛似的。之后速度能不能提到年均4-5家,跟四季、安缦在中东、亚洲掰手腕、抢地盘? 成了:酒店数量翻倍,市场份额上去,规模效应就能出来。 算力、网力、存力,这数据中心的三件套,平头哥全部实现了自研。 放眼整个中国芯片行业,能做到这一点的企业,用一只手就能数得过来。 恰恰是在硬件布局已经相当完整、产品力已经充分验证的这个节点,平头哥走出了关键破局的一步棋,开源AI软件栈。 56万片出货、400多家客户已经足够证明产品力,但止步于此,终究只是一家芯片供应商。 不成:那就是龟速前进,眼睁睁看着别人把好地方都占光了,自己越来越边缘。 要建一个真正的芯片生态,应该让开发者可以基于你的平台做创新、研究机构能用你的工具链产出、产业伙伴围绕你的技术栈开发解决方案。

| 开源软件栈的本质,就是先降低开发者的使用门槛,再把建设的权利也一并交出去。 平头哥在这次开源中提出将与全球开发者、科研机构及产业伙伴一起,共同打磨工具链、丰富算子生态、优化性能体验。

| 第三,是最实在也是最难的,赚钱能力得提上来。 对文华东方来说,比较理想的情况是净利润率从现在的5.8%爬到10%以上。但这不是说说就行的。

| 落点在共同两个字上,依托经过真实业务验证的成熟算力底座,生态的后续拓展交由全行业协同完成。 就单说从RevPAR上要利润这事。 文华东方的房价本身就不便宜。 某种意义上,这也是国内AI算力生态最缺的一环,国内硬件追赶力度充足,但软件生态积淀不足; 生态的厚度需要时间,更需要先有人敞开技术大门,吸纳全行业力量共建。 最后回到名字本身,T-Head SAIL中的SAIL,全称是Seed of AI Library。 用平头哥自己的话说,他们把每一行开源代码都视作一颗蕴含无限可能的种子,期待未来国内AI生态能在共建中蔚然成林。想提高RevPAR,要么降价走量,要么在原有价格上再提升入住率,但无论怎么做,都有难度。

| 那么再换一种思路就是,文华东方必须在运营成本上抠得更细,而且服务还不能拉胯。得把每一分钱都得花在刀刃上。

| 但对于一个奢华酒店来说,这其实也不容易。

| 5 所以,说句公道话。 即便文华东方的私有化,是被股价、盈利、竞争三座大山压得喘不过气,迫不得已才使出的“缓兵之计”,是一次被逼到墙角的“战术调整”…… 但我们至少得对这份“挣扎”保留一丝敬意。 想想看,一个148岁的老字号,什么大风大浪没见过?它本可以倚老卖老,躺在功劳簿上吃老本,靠着“传奇历史”这口仙气续命,直到优雅地老去。 但它没有。 它选择在年近古稀的时候,亲手打破自己熟悉的玩法,卖掉家当,换个赛场重新起跑。 这需要的不是一点半点勇气。 这就像一位武林名宿,到了这个岁数,不甘心只用祖传的几招应付场面,偏要闭关修炼,去捣鼓什么全新武功——成则宗师再临,败则晚节不保。 这种“不认命、不躺平”的劲儿,在这个动不动就“躺平算了”的时代,反而显得有点珍贵,甚至有点悲壮。

| 当然,情怀不能当饭吃,尊重也换不来股价。 这次豪赌最终的结局,是涅槃重生,还是温水煮青蛙? 咱们谁说了都不算。唯一的裁判,只有一个——那就是时间。 就这样,散会。

|
Current article:http://rueyhq.shengyaodanrongchui.buzz/list_t0snrrf/yelq3pn.html
Published on:15:15:27