Nebius全栈AI云揭秘 开源模型推理成本降70%
近期机构研报指出,Nebius代表了一种新兴AI云范式,正在推动AI推理从闭源模型依赖向开源模型替代的结构性迁移。研报认为,其自研高密度ODM机架和液冷方案使服务器功耗降低约20%,相比AWS,微调TCO便宜43%,推理TCO便宜112%。此外,GPU弹性打包与双栈调度优化还能回收5-15%的闲置算力。 研报指出,公司收购Eigen AI后推出的Token Factory,可将单GPU Token吞吐提升2-3倍,在硬件成本不变的情况下显著增加收入,同时大幅降低客户全链路部署成本。实际案例中,Revolut因成本压力全面迁移至Kimi 2.5模型,Cosine通过Papyrax框架将Llama 3.3 70B优化至接近OpenAI O3水平。Shopify和Coinbase等企业也通过类似开源路径实现AI支出接近减半。 研报认为,这种成本优势将加速AI应用落地,扩大整体算力需求,为AI云服务商和产业链相关公司打开长期增长空间。尽管存在宏观波动和竞争加剧可能,但开源平权化带来的降本增效趋势已较为明确,相关领域正迎来重要发展机遇。 中财网
![]() |