![]()
官方背景
Fireworks AI 由 PyTorch 原班人马创立,定位极速、低延迟的生产级推理平台,主打 Serverless 2.0。其自研 FireFunction-V2 函数调用模型在多工具评测达 92.1% 准确率,达到 GPT-4o 级别、速度却快 2.5 倍、成本仅 10%。平台托管 400+ 模型,2025 年 10 月起日处理超 10 万亿 token,客户含 Notion、Sourcegraph、Cursor、Quora。
核心能力
① Serverless 2.0:极低首字延迟的推理;② FireFunction-V2:高精度函数调用,适合 agent;③ 400+ 模型:LLM、视觉、图像(Flux 1.1 Pro);④ OpenAI 兼容 API;⑤ 按需 GPU(H100/H200 $7、B200 $10、B300 $12/小时);⑥ 流式输出;⑦ SOC 2 / HIPAA / GDPR 合规。
应用场景
对延迟敏感的线上 LLM 应用;需要函数调用能力的 agent;用 Flux 做图像生成;RAG 与检索增强;为高吞吐产品(Cursor、Notion 级别)做模型服务。一句话——要「又快又稳又便宜」的生产推理,找它。
定价与可及性
按 token 计费:Llama 70B $0.90/百万、Llama 8B $0.20/百万、DeepSeek V3 $0.50/百万,图像 Flux 1.1 Pro $0.04/张;新用户赠 $1 免费额度。按需 GPU H100/H200 $7、B200 $10、B300 $12/小时。提供 REST API 与多语言 SDK。
Fireworks AI · Fireworks AI 由 PyTorch 原班人马创立,定位极…
暂无评论内容