排序
Together AI:一站托管 200+ 开源大模型的 AI 原生云,推理快一半、便宜六成
官方背景 Together AI 是'AI 原生云'(AI Native Cloud),提供从推理、微调到预训练的全栈开源 AI 平台,已完成 8 亿美元 C 轮。它把 Llama、DeepSeek、Qwen、Kimi、GLM、MiniMax、Nemotron、F...
LongCat:美团开源的 MoE 大模型家族,560B 总参却只激活 27B 的省电怪兽
官方背景 LongCat 是美团开源的 MoE(混合专家)大语言模型家族,以「高吞吐、低激活」著称。旗舰 LongCat-Flash 总参 5600 亿、每次仅激活约 270 亿;LongCat-Flash-Lite 总参 685 亿、激活仅 ...
零一万物 Yi:李开复创办的国产大模型,Yi-Lightning 每百万 token 仅 0.99 元
官方背景 零一万物(01.AI)由李开复于 2023 年创办,是国产大模型'六小虎'之一,成立 8 个月即跻身独角兽,背后有阿里、小米等支持。公司坚持开源与闭源双轨:开源 Yi-6B / 34B、Yi-1.5、Yi-VL...
GLM-5.2:智谱 744B 开源旗舰,Intelligence Index 开源模型全球第一
官方背景 GLM-5.2 是智谱 AI(国际品牌 Z.ai)于 2026 年 6 月 13 日发布 API、6 月 17 日以 MIT 协议开源的旗舰模型。它沿用约 744B(753B)总参数、40B 激活的 MoE 架构,支持 1M tokens 无损...
通义千问
通义千问(Qwen)是阿里云推出的大语言模型家族,由阿里巴巴通义实验室研发。自 2023 年 4 月发布以来,已成为全球最受欢迎的开源大模型系列之一,全球累计下载超 3 亿次,衍生模型超 10 万个,...
Gemma 3:Google 开放权重多模态模型,27B 跑分反超 Llama 405B
官方背景 Gemma 是 Google DeepMind 推出的开放权重模型家族,名字源自拉丁语'宝石',与 Gemini 同源(共享 Gemini 2.0 的研究与架构)。最新一代 Gemma 3 于 2026 年 3 月 12 日发布,是 Gemma...
DeepCogito:混合推理开源模型,Cogito v1/v2 最大 671B MoE,IDA 训练
官方背景 DeepCogito 是专注「混合推理(hybrid reasoning)」的开源模型实验室,用迭代式蒸馏与抽象(IDA, Iterative Distillation and Abstraction)在 Llama / Qwen 等基座上训练出 Cogito ...
DeepSeek
DeepSeek(深度求索)是杭州深度求索人工智能基础技术研究有限公司推出的 AI 助手,公司成立于 2023 年,由量化私募幻方量化创立,以极致的训练效率与开源策略闻名全球。当前网页端、APP 与 API...
Cline:开源的自主编码 Agent,把 VS Code 变成会自己写代码的实习生
官方背景 Cline 是一款开源的自主编码 Agent,以 VS Code / Cursor / VSCodium 扩展形式运行,采用 MIT 协议,2023 年底发起、社区驱动。它不是一个代码补全工具,而是一个能读写文件、执行命令...
别再花钱调API!阿里开源Qwen3.8-27B:一块4090把旗舰大模型跑进自家电脑(三条部署路线)
第一章 一句话结论:27B 能干翻一票闭源,还免费 别再傻乎乎地花钱调 API 了。阿里 8 月 14 号晚上开源的 Qwen3.8-27B,真把'自己家门口跑旗舰大模型'这件事,变成了消费级显卡就能搞定的事。 2...