DeepCogito:混合推理开源模型,Cogito v1/v2 最大 671B MoE,IDA 训练

DeepCogito

官方背景

DeepCogito 是专注「混合推理(hybrid reasoning)」的开源模型实验室,用迭代式蒸馏与抽象(IDA, Iterative Distillation and Abstraction)在 Llama / Qwen 等基座上训练出 Cogito 系列。v1 / v2 覆盖 3B 到 671B MoE,以「先想后答」的可控推理著称。

核心能力

混合推理:模型可切换快答 / 慢思考两种模式;② 基于 IDA 把强模型推理能力蒸馏到小模型;③ 覆盖 3B–671B MoE 多尺寸(稠密 + MoE);④ 数学 / 代码 / agentic 基准表现强;⑤ 完全开放权重,可在 Hugging Face / Fireworks / Together / OpenRouter 取用;⑥ 支持微调与自部署。

应用场景

需要可控推理成本的产品——简单问题快答、难题开慢思考;本地 / 私有部署的推理应用(开源权重);研究社区基于 Cogito 做二次蒸馏与评测;Agent 后端用其强推理能力。它把「前沿推理」按需拆成了可负担的档位。

定价与可及性

权重开源免费(Apache 风格许可,具体见 repo);推理按托管平台(Fireworks / Together / OpenRouter)计费。Hugging Face 直接下载,deepcogito.com 提供说明,适合研究、自部署与成本敏感型生产。

立即体验 DeepCogito →

DeepCogito · DeepCogito 是专注「混合推理(hybrid reasoning)」的开源模型实验室,用迭代…

© 版权声明
THE END
喜欢就支持一下吧
点赞85 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容