排序
vLLM:UC Berkeley 开源推理引擎,PagedAttention 把吞吐拉满
官方背景 vLLM 是 UC Berkeley Sky Computing Lab 开源的大模型推理引擎,核心创新是 PagedAttention 显存管理与 Continuous Batching 连续批处理,把 GPU 利用率和吞吐打到极致。2025 年 1 月...
MetaGPT:把软件公司塞进一个开源多智能体框架,一句话生成完整项目
官方背景 MetaGPT 是开源的多智能体软件工程框架,由 geekan(向劲宇)等人发起,GitHub 上 5 万–6.6 万 star,采用 MIT 协议。它的核心理念是 Code = SOP(Team)——把一家软件公司的标准作业...
LM Studio:把开源大模型跑在自己电脑上,免命令行、免 API 账单
官方背景 LM Studio 由 Element Labs 于 2023 年推出,是当下最友好的本地大模型桌面应用。它把 Llama、Mistral、DeepSeek、Qwen、Gemma、Phi、gpt-oss 等开源权重直接跑在你的电脑上——无云、...
Nous Research:靠 Hermes 模型家族走红的开源权重 AI 实验室,10 亿美元估值背后的”中性对齐”
官方背景 Nous Research 是 2023 年由 Jeffrey Quesnelle、Teknium、Karan Malhotra、Shivani Mitra 创立的开放权重 AI 实验室,最初是 Discord / GitHub 上零融资的志愿者小组。以 Hermes 系列...
全球最大开源模型来了!Kimi K3 实测:换一个网址,老工具全接入,百万上下文塞整库
第一章 先说结论:2.8 万亿参数的开源核弹 2026 年 8 月,AI 圈最炸的不是新手机,是一个开源模型:Kimi K3。月之暗面 7 月 27 号把完整权重开源,上线 48 小时请求量直接打满集群,逼得官方暂...
Together AI:一站托管 200+ 开源大模型的 AI 原生云,推理快一半、便宜六成
官方背景 Together AI 是'AI 原生云'(AI Native Cloud),提供从推理、微调到预训练的全栈开源 AI 平台,已完成 8 亿美元 C 轮。它把 Llama、DeepSeek、Qwen、Kimi、GLM、MiniMax、Nemotron、F...
零一万物 Yi:李开复创办的国产大模型,Yi-Lightning 每百万 token 仅 0.99 元
官方背景 零一万物(01.AI)由李开复于 2023 年创办,是国产大模型'六小虎'之一,成立 8 个月即跻身独角兽,背后有阿里、小米等支持。公司坚持开源与闭源双轨:开源 Yi-6B / 34B、Yi-1.5、Yi-VL...
Featherless:无 GPU 管理、一口价无限调用的开源大模型托管,4.7 万+ 模型随便换
官方背景 Featherless AI 是由 RWKV 项目研究者创立的 AI 推理实验室 / 服务商,主打'开放权重的无 Transformer 注意力'架构研究,并声称把 70B 级模型的架构验证成本从 500 万美元砍到 5 万美...
DeepCogito:混合推理开源模型,Cogito v1/v2 最大 671B MoE,IDA 训练
官方背景 DeepCogito 是专注「混合推理(hybrid reasoning)」的开源模型实验室,用迭代式蒸馏与抽象(IDA, Iterative Distillation and Abstraction)在 Llama / Qwen 等基座上训练出 Cogito ...
DeepSeek
DeepSeek(深度求索)是杭州深度求索人工智能基础技术研究有限公司推出的 AI 助手,公司成立于 2023 年,由量化私募幻方量化创立,以极致的训练效率与开源策略闻名全球。当前网页端、APP 与 API...