Featherless:无 GPU 管理、一口价无限调用的开源大模型托管,4.7 万+ 模型随便换

Featherless

官方背景

Featherless AI 是由 RWKV 项目研究者创立的 AI 推理实验室 / 服务商,主打”开放权重的无 Transformer 注意力”架构研究,并声称把 70B 级模型的架构验证成本从 500 万美元砍到 5 万美元(降 95%+)、推理成本降 10 倍以上。其托管平台是 Hugging Face 上模型数量最大的推理服务商之一,截至 2026 年中提供 3.2 万+(页面称最高 4.74 万+)开源模型、约 1 万客户。

核心能力

Serverless 推理——动态加载 / 换模,无需自建 GPU、默认不记录 prompt / completion;② 单一 OpenAI 兼容 API key 接入整个 Hugging Face 目录(Llama、Qwen、DeepSeek、GLM、Gemma 及大量角色扮演 / 代码微调);③ 新模型达 100+ 下载即自动上架;④ 号称冷启动 <250ms;⑤ 集成 LangChain / LiteLLM / HF Inference Providers;⑥ 提供 Agent 运行时(持久沙箱存储)。

应用场景

重度实验多开源模型的开发者 / 初创 / 研究 / 智能体团队、角色扮演与创意写作应用(WyvernChat、NovelCrafter 等)、想摆脱按 token 计费、追求可预测成本的生产推理;企业可在自有云上跑自有模型目录,从云端减掉 GPU 运维负担。

定价与可及性

采用一口价订阅(非按 token):入门约 $10/月起无限请求(小模型类、并发有限),Premium $25/月(全目录、4 并发、32K 上下文),Agent Standard $100/月(≤229B 参数、8 并发、256K),Agent Pro $200/月(全目录、256K);另有按请求 / credit 的弹性选项。无免费层,并发上限随档位提升;目录质量参差、高级工具调用并非全模型支持。

立即体验 Featherless →

Featherless · Featherless AI 是由 RWKV 项目研究者创立的 A…

© 版权声明
THE END
喜欢就支持一下吧
点赞86 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容