排序
Ollama:一行命令在本地跑 Llama / Mistral / Qwen / DeepSeek,彻底告别云端依赖的 AI 运行时
官方背景 Ollama 是 MIT 开源的本地大语言模型运行时,由前 Apple 工程师 Jeffrey Morgan 创办,底层基于 llama.cpp 推理引擎,包装成类似 Docker 的 CLI + REST API。2025 年 7 月推出跨 macOS...
NVIDIA Nemotron:英伟达开源智能体模型家族,Nano/Super/Ultra 覆盖语言多模态与语音
官方背景 NVIDIA Nemotron 是英伟达面向'智能体式 AI(Agentic AI)'打造的开源基础模型家族,2026 年持续扩展:Nemotron 3 系列涵盖 Nano(30B-A3B)、Super(120B-A12B)、Ultra(550B-A55B)...
DeepSeek
DeepSeek(深度求索)是杭州深度求索人工智能基础技术研究有限公司推出的 AI 助手,公司成立于 2023 年,由量化私募幻方量化创立,以极致的训练效率与开源策略闻名全球。当前网页端、APP 与 API...
Kimi K3:月之暗面发布 2.8 万亿参数开源旗舰,全球首个 3 万亿级开放权重模型
官方背景 Kimi K3 是月之暗面(Moonshot AI)于 2026 年 7 月 16 日发布的新旗舰,参数规模 2.8 万亿,是全球首个进入 3 万亿参数级别的开源权重模型,也是目前最大的开源模型。API 即刻可用,...
通义千问
通义千问(Qwen)是阿里云推出的大语言模型家族,由阿里巴巴通义实验室研发。自 2023 年 4 月发布以来,已成为全球最受欢迎的开源大模型系列之一,全球累计下载超 3 亿次,衍生模型超 10 万个,...
Ling-3.0-flash:蚂蚁百灵发布原生混合推理模型,124B 总参仅激活 5.1B 限时免费
官方背景 Ling-3.0-flash 是蚂蚁集团旗下百灵大模型于 2026 年 7 月 24 日发布的新一代原生混合推理模型。总参数 124B、每 token 仅激活 5.1B(激活占比约 4%),却在推理、指令遵循与长文本上...