Together AI:一站托管 200+ 开源大模型的 AI 原生云,推理快一半、便宜六成

Together AI

官方背景

Together AI 是”AI 原生云”(AI Native Cloud),提供从推理、微调到预训练的全栈开源 AI 平台,已完成 8 亿美元 C 轮。它把 Llama、DeepSeek、Qwen、Kimi、GLM、MiniMax、Nemotron、FLUX 等 200+ 开源模型统一到一个 OpenAI 兼容 API 下,是 Cursor 等产品的实时低延迟推理底座。

核心能力

Serverless 推理:按 token 计费、自动扩缩;② Batch 异步批处理(最高省 50%,单次可达 300 亿 token);③ Provisioned Throughput 预留算力、99% 可用性 SLA、比闭源 API 低至 90% 成本;④ 专属端点/容器 控延迟与生成式媒体;⑤ 一行代码微调(LoRA/DPO/RLHF);⑥ 71+ 模型免费、支持图像/视频/语音与嵌入重排。

应用场景

想用开源模型替代 GPT/Claude 又不想自建 GPU 的团队;需要微调自有模型的中小企业与研究者;做大规模数据标注、离线摘要、合成数据的批处理;追求更低单价的生产级推理。

定价与可及性

新账户送 $5 额度,无月费;按 token 计费,小模型约 $0.10/百万输入起(如 Llama 3.1 8B),DeepSeek V4 Pro 输入 $0.20 / 输出 $3.48 每百万;Batch 5 折。71+ 模型免费试用,创业公司最高可获 $5 万额度。

立即体验 Together AI →

Together AI · Together AI 是”AI 原生云”(AI Native C…

© 版权声明
THE END
喜欢就支持一下吧
点赞88 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容