Together AI 在 2026 年 7 月 1 日完成一轮 8 亿美元的 Series C 融资,随着企业将开源 AI 模型投入生产,这家“neocloud”公司的估值升至 83 亿美元。该轮融资由 Aramco Ventures 领投,芯片制造商 Nvidia、Vista Equity Partners 和 General Catalyst 参与投资。
为开放模型而建的云
Together AI 的平台为开源模型提供 serverless inference、dedicated infrastructure 和 batch inference,运行在 Nvidia GPU 上。其核心是一款名为 ATLAS 的专有引擎,采用 adaptive speculative decoding——由轻量级模型先起草回复,再由主模型进行验证和修正——公司称这可将部分推理工作负载的速度提升最高 400%。
这轮融资背后的业务
公司披露,2026 年第二季度 annual bookings 已超过 11.5 亿美元。公司称,与 closed-model APIs 相比,客户可将推理成本降低 6 倍至 20 倍,并援引客户服务公司 Decagon 在迁移至其平台后实现六倍成本下降的案例。
资金将投向何处
Together AI 计划用这笔资金扩展产品,推进成为领先的 inference provider,并大幅扩张其算力规模——公司预计其 footprint 在未来五年将增长约 50 倍。除股权投资外,投资方还承诺提供超过 500 megawatts 的算力容量,这部分将独立于本轮融资进行融资。
开放与封闭之争
这轮融资落地之际,来自 DeepSeek、Alibaba 的 Qwen、Meta 的 Llama 和 Mistral 的 open-weight 模型正不断缩小与 closed APIs 的差距,这让专门运行开放模型的云服务对希望控制成本和部署方式的企业更具价值。Together AI 的主张是,更低的推理成本以及可由客户自行选择模型运行位置的自由,将持续把这类工作吸引到其平台上。
