排序
OpenAI 七年首次开源!GPT-OSS 本地部署教程:一张显卡,把前沿大模型跑在自己电脑上
第一章 OpenAI 终于'开源'了——但这次是真的 说出来你可能不信:OpenAI 上一次正经开源,还是 2019 年的 GPT-2。 七年。整整七年,这家公司把'开放'两个字焊死在嘴上、把权重锁死在服务器里。...
LM Studio:把开源大模型跑在自己电脑上,免命令行、免 API 账单
官方背景 LM Studio 由 Element Labs 于 2023 年推出,是当下最友好的本地大模型桌面应用。它把 Llama、Mistral、DeepSeek、Qwen、Gemma、Phi、gpt-oss 等开源权重直接跑在你的电脑上——无云、...
千问27B开放权重本周放出!一张游戏卡跑本地大模型:4-bit量化+微调,数据不出域
第一章 27B 的千问来了:这次你能真把它装进自己电脑 大模型平民化这件事,阿里又往前推了一步。就在本周(8 月 10 日那周),通义千问团队要把 Qwen3.8-27B 的开放权重正式放出来。 27B 是什么...
Ollama:一行命令在本地跑 Llama / Mistral / Qwen / DeepSeek,彻底告别云端依赖的 AI 运行时
官方背景 Ollama 是 MIT 开源的本地大语言模型运行时,由前 Apple 工程师 Jeffrey Morgan 创办,底层基于 llama.cpp 推理引擎,包装成类似 Docker 的 CLI + REST API。2025 年 7 月推出跨 macOS...
别再花钱调API!阿里开源Qwen3.8-27B:一块4090把旗舰大模型跑进自家电脑(三条部署路线)
第一章 一句话结论:27B 能干翻一票闭源,还免费 别再傻乎乎地花钱调 API 了。阿里 8 月 14 号晚上开源的 Qwen3.8-27B,真把'自己家门口跑旗舰大模型'这件事,变成了消费级显卡就能搞定的事。 2...
断网也能用、数据不出本机?Ollama本地部署实测:一条命令白嫖大模型,API钱都不用花
你有没有过这种纠结:想用AI处理点敏感文档——合同、客户名单、公司内部资料,可一想到要把这些内容发给某个云API,心里就发毛。断网了AI就罢工?API涨价你的成本就炸?模型厂商哪天改政策,你...
Open WebUI:可完全离线的自托管 AI 平台,把本地模型变成 ChatGPT
官方背景 Open WebUI(原 Ollama WebUI)是一个可完全离线的自托管 AI Web 平台。它既支持本地 Ollama,也兼容任意 OpenAI 兼容 API(Groq、Mistral、OpenRouter、LM Studio、vLLM 等)。项目 G...
开会录音别再花钱转写了!微软VibeASR.cpp:普通CPU实时跑,比Whisper快2倍
开会录音别再花钱转写了!微软VibeASR.cpp:普通CPU实时跑,比Whisper快2倍 开会两小时,转写等半天,还得花钱买会员?更别提有些录音涉及到合同、病历、内部战略,往第三方服务器一传,心里就...