人工智能行业专题(19):从Nebius看新兴云与开源模型Token优化
请务必阅读正文之后的免责声明及其项下所有内容2026年07月24日人工智能行业专题(19)从Nebius看新兴云与开源模型Token优化证券研究报告 | 行业研究 · 海外市场专题 互联网 · 互联网Ⅱ投资评级:优于大市(维持)证券分析师:张伦可证券分析师:陈淑媛0755-81982651021-60375431zhanglunke@guosen.com.cnchenshuyuan@guosen.com.cnS0980521120004S0980524030003请务必阅读正文之后的免责声明及其项下所有内容核心结论• Nebius 是全栈自研 AI 原生云代表厂商,工程基因是核心壁垒。公司脱胎于 Yandex,继承 20 年分布式基础设施能力,形成“裸金属算力→多租户云→Token Factory 托管推理(25年底落地)→智能代理层(规划)”的四层产品架构。Nebius代表的不仅GPU租赁商,而是一种"全栈垂直整合"的新兴AI云范式——通过硬件自研、编排自控、模型自优化的三层能力叠加,将开源模型的推理成本最高砍掉70%,从而推动AI推理从"闭源模型依赖"向"开源模型替代"的结构性迁移。• 底层:自研高密度 ODM 机架与工程基因构建成本护城河。比较AWS,AWS微调的TCO(总拥有成本)比Nebius贵43%,推理TCO(总拥有成本)贵112%。新兴云具备裸金属去虚拟化、InfiniBand直连、无通用云搭售等成本优势。特殊的是,根据SemiAnalysis和官网,Nebius是唯一一家使用定制ODM机箱的新兴云厂商,预计节省10-15%OEM溢价。根据官方白皮书,自研液冷方案将服务器功耗降低约20%。除此以外,Nebius拥有GPU 弹性打包 + 双栈调度回收侧优化,相比较其他新兴云能够回收约5-15%闲置算力。• 中层:Token Factory通过收购Eigen AI实现模型层全栈优化,帮助提升单GPU收入,客户部署成本下降。Eigen 推理优化让单卡 Token 吞吐提升 2-3 倍,从而把单卡Token产出提升至2-3倍,与此同时,Token价格基本和原模型一致。所以,同样的硬件成本Nebius能卖出更多收入。除此以外,对于客户来说,Nebius Token Factory的Token优化能力可有效降低客户AI推理部署的全链路成本。传统部署路径下,客户若选择裸金属自部署,需要用更多的卡完成同等每日Token量需求。• Token Factory案例一定程度证实了"开源替代闭源模型"的经济性。Revolut因成本失控从顶尖闭源模型全面迁移至Token Factory上的Kimi 2.5;Cosine因银行/国防客户的数据不出墙要求,通过Papyrax后训练框架将Llama 3.3 70B调教至OpenAI O3水平。非Nebius案例同样印证趋势:Shopify将Qwen3-32B微调后推理速度2.2倍、成本下降68%;Coinbase形成"开源模型GLM-5.2、Kimi2.7承接常规调用、闭源模型处理复杂任务"的分层架构,AI支出接近减半。2请务必阅读正文之后的免责声明及其项下所有内容目录Nebius与传统云比较01Nebius成本、Token优化02Token优化案例0304Nebius财务分析请务必阅读正文之后的免责声明及其项下所有内容Nebius:欧洲为主的算力租赁厂,工程基因是是底层优势• Nebius 是一家总部位于荷兰阿姆斯特丹的 AI 原生云基础设施公司,2024 年完成重组后定位为"从硅片到 API"全栈自建的 AI 云。• Nebius 拥有接近20年的互联网基础。它脱胎于纳斯达克上市科技巨头 Yandex(前身为"俄罗斯谷歌+优步),继承了上千名顶尖分布式软件工程师与 20 年的大厂全栈内功;在其他 AI 云在当靠出租 GPU 赚差价时,Nebius 已经凭借超大规模调度、自动化故障自愈以及深度的网络软件拓扑能力,将昂贵的万卡集群打造成了无缝续传、压榨出极限性能的“精装自动化 AI 工厂”。4图:公司发展历程2000—2023年Yandex体系技术积累依托Yandex体系,长期深耕搜索、云计算、数据中心及AI基础设施,形成大规模工程研发与算力运营能力。2024年7月业务重组完成Yandex N.V.完成俄罗斯业务剥离,保留AI云、自动驾驶、数据服务及教育科技等国际业务板块。2024年8月品牌焕新公司完成更名并启用Nebius Group品牌,明确聚焦全球AI基础设施与AI云服务市场。2024年10月重返资本市场以股票代码“NBIS”恢复纳斯达克交易,成为资本市场较为稀缺的AI基础设施上市标的。2024年12月战略融资落地完成7亿美元私募融资,英伟达、Accel等机构参投,加速GPU集群部署及数据中心建设。2025年至今全球化与平台化提速持续扩建欧美AI基础设施,业务由底层GPU算力向多租户AI云、托管推理及全栈AI云平台持续延伸。资料来源:公司公告,国信证券经济研究所整理请务必阅读正文之后的免责声明及其项下所有内容Nebius:管理层经验深厚,延续Yandex技术积淀• Nebius由Yandex联合创始人Arkady Volozh带领,管理层长期深耕搜索、云计算、分布式系统及数据中心建设,具备大型科技平台从技术研发到商业化运营的完整经验。• 根据公司披露,Nebius承接Yandex核心技术团队,公司披露拥有超过1000名具备长期协作经验的AI工程师,覆盖AI基础设施及相关技术研发。成熟的工程团队与软硬件一体化能力,有望缩短AI基础设施建设周期,并支撑公司由底层算力向多租户云、托管推理及全栈AI云平台持续延伸。5图:Nebius核心管理层情况姓名职位主要职责及背景Arkady Volozh创始人、首席执行官兼董事Yandex联合创始人,长期负责大型科技平台建设;主导Nebius战略规划、全球AI基础设施布局及重大资本决策。Ophir Nave首席运营官兼董事负责集团日常运营、组织管理、资源配置及公司战略落地,与CEO共同参与核心经营决策。Roman Chernin首席商务官负责商业战略、客户拓展及合作伙伴关系建设,推动AI算力与云服务的商业化。Andrey Korolenko首席基础设施与产品官负责数据中心、GPU集群、云基础设施及产品体系建设,推动软硬件一体化AI云平台落地。Dado Alonso首席财务官负责财务管理、融资、资本配置、预算及投资者关系,为数据中心扩张和全球化投入提供支持。Marc Boroditsky首席营收官负责全球销售体系、收入增长及大型客户拓展,推动基础设施资源向订单和收入转化。Danila Shtan首席技术官负责核心技术架构与研发体系,重点覆盖AI云平台、计算基础设施及底层技术能力建设。资料来源:公司公告,国信证券经济研究所整理请务必阅读正文之后的免责声明及其项下所有内容Nebius:从基础设施租赁到Token Factory,软件附加值增加• Nebius 的产品战略围绕"四层架构"展开,核心逻辑是:越往上层走,可服务的客户群数量呈十倍增长、差异化以及软件附加值越高。①裸金属基础设施(按兆瓦计费,服务微软/Meta 级别
[国信证券]:人工智能行业专题(19):从Nebius看新兴云与开源模型Token优化,点击即可下载。报告格式为PDF,大小1.24M,页数36页,欢迎下载。



