视频号
    标题 摘要 内容
    详情

    全球 AI 算力龙头英伟达联合数字基础设施服务商 Equinix、开源推理平台 Together AI,正式发布Equinix Inference Exchange分布式 AI 推理服务平台,面向全球企业提供生产级开源大模型推理能力,计划 2027 年第一季度正式上线。


    随着生成式 AI 进入规模化落地阶段,推理已经成为企业 AI 业务的核心瓶颈。大量企业面临模型部署成本高、时延难以控制、数据合规约束、开源模型生产化改造复杂等现实难题。传统集中式算力部署模式,难以兼顾性能、成本、数据主权与低访问时延的多重诉求,企业亟需一套可快速从实验走向生产的端到端推理解决方案。


    Equinix Inference Exchange 整合三方核心能力,构建完整的分布式推理交付体系:英伟达输出经过验证的企业级 AI 参考架构,提供算力硬件与全套 AI 软件栈,为推理负载提供高吞吐、低成本的底层算力底座;Together AI 提供推理运行平台,原生支持 200 余款主流开源模型,降低企业使用开源模型的开发门槛;Equinix 依托遍布全球的数据中心资源与 Equinix Fabric 互联网络,实现推理节点就近部署,对接多云、网络与 AI 生态资源,保障业务低时延、安全互联。


    该方案重点解决企业三大核心诉求:一是就近部署降低访问时延,将推理算力部署靠近业务与数据源,减少数据远距离传输;二是推动企业从闭源模型向开源模型迁移,帮助企业控制 AI 应用成本;三是满足监管合规要求,支持推理任务限定在指定地域机房运行,实现数据不出境,适配金融、政务等强监管行业场景。


    三方分工协作,把硬件算力、推理平台、全球基础设施打包为一体化服务,大幅降低企业自建 AI 推理集群的技术门槛与资金投入。企业无需从零完成硬件选型、组网调优、模型适配工作,即可快速将开源大模型投入实际业务生产,缩短 AI 项目落地周期。