Rebellions 与 ai& 在日本部署节能 AI 推理基础设施
Rebellions 与 ai& 宣布在东京数据中心引入 RebelRack,打造本地化、低延迟且能耗大幅降低的 AI 推理服务,目标在 2026 年底实现多站点部署。

2026 年 9 月 15 日,Rebellions 通过官方渠道发布声明,正式宣布其子公司 ai& 将在东京的一个专用数据中心内部署 RebelRack 设备,构建面向企业、政府部门以及开发者的本地化 AI 推理平台。该平台基于异构计算架构,融合了 CPU、GPU、以及专用加速器等多种计算单元,旨在实现低于 50 毫秒的本地响应时间。与此同时,Rebellions 还声称,这套系统在能源成本方面能够实现最高 80% 的节约,从而在满足性能需求的同时显著降低运营支出。
在首次部署阶段,Rebellions 计划在东京数据中心内部署 100 台 RebelRack 机架式设备。虽然当前的规模仍属目标设定,但公司已经明确表示,所有设备将在交付的同一天即可投入使用。得益于已经成熟的开源推理框架,如 TensorRT、ONNX Runtime 等,平台能够实现快速上线,企业无需进行繁琐的二次开发即可直接迁移现有模型进行推理。
资本投入与扩展计划
ai& 在公开文件中透露,已承诺投入超过 20 亿美元用于全球基础设施建设,计划在全球范围内设立五个运营站点,并力争在 2026 年底完成全部站点的建设工作。每个站点的设计功率目标为 8 兆瓦,整体在 2027 年实现 40 兆瓦的供电能力。与此同时,ai& 还在全球范围内推进超过 100 兆瓦的容量开发计划,这一宏大的目标显示出公司在能源布局和算力扩容方面的雄心。但需要注意的是,全球站点的时间表和规模与日本本土的部署计划并不完全同步,企业在评估时应结合自身的业务需求和区域布局进行权衡。
技术优势与商业主张
Rebellions 将 RebelRack 定位为专为推理任务优化的硬件平台,强调其在能效比和成本上的双重优势。硬件内部采用高密度散热设计和低功耗加速器,使得在相同算力下的能耗显著低于传统服务器。更重要的是,该平台支持在日本本土完成模型推理,避免了跨境数据传输,从而保障了数据主权。对于对实时性要求极高的行业,如金融交易、智能制造和自动驾驶等,平台能够提供低延迟服务,帮助用户在毫秒级别内获得推理结果。
- 本地化推理,数据不出境
- 延迟低于 50 毫秒
- 能源成本最高可降低 80%
- 兼容主流开源推理框架
风险评估与建议
在决定采用该基础设施之前,企业需要对多个关键因素进行审慎评估。首先要确认数据实际驻留的位置,确保符合当地的数据合规要求;其次要检查日志记录方式是否满足审计需求,并评估模型版本管理的完整性。软硬件依赖的可维护性也是重点,需要了解供应链的支持周期以及备件的可获得性。系统的容错恢复能力、能耗基准测试结果以及整体拥有成本(包括资本支出和运营支出)都应纳入评估范围,以避免在实际部署后出现不可预见的费用或性能瓶颈。
对于在华的跨国公司以及本土机构而言,Rebellions 与 ai& 的合作提供了一条在日本本土实现高效 AI 推理的可行路径。通过本地部署,企业能够显著降低跨境数据传输带来的风险,提升对数据主权的控制力度,同时受益于日本政府对节能减排的政策支持。
针对中国境内的组织,在考虑使用此类日本本土化推理平台时,应重点核查以下几点:平台是否符合《网络安全法》及《数据安全法》中对跨境数据传输的限制;本地化部署是否提供足够的审计日志,以满足监管部门的合规检查;能源消耗报告是否透明,可供内部 ESG(环境、社会、治理)评估使用;以及硬件供应链是否具备可追溯性,确保在出现技术故障时能够快速获取支持。只有在这些要点都得到充分验证后,组织才能安全、合规地利用该基础设施提升 AI 推理能力。
信息来源
- Rebellions and ai& Partner to Bring Energy-Efficient AI Inference Infrastructure to JapanRebellions · 2026年9月15日
- Sovereign AI Inference, Built in Japanai& · 2026年9月16日



