
LM Studio
的使用方法、功能与可解决的业务课题
添加书签
LM Studio是什么?
美国 Element Labs, Inc. 提供的桌面应用,可在界面上浏览 Qwen、Gemma、gpt-oss、DeepSeek 等开放模型,下载到自己的电脑(Mac、Windows、Linux)上,用于聊天或作为兼容 OpenAI 的本地 API 服务器。个人使用和工作使用均免费,界面可切换为日语。其姊妹 AI 智能体应用“LM Studio Bionic”还提供可使用云端开放模型的付费方案(Bionic+ 每月 20 美元、Pro 每月 100 美元)。
可解决的业务课题
「LM Studio」的服务详情
什么是 LM Studio
LM Studio 是一款可在界面上浏览 Qwen、Gemma、gpt-oss、DeepSeek 等开放 AI 模型,下载到自己的电脑后即可直接聊天的桌面应用。它支持 Mac、Windows 和 Linux,从搜索、下载、加载模型到开始对话,都无需输入命令,只在应用界面中即可完成。模型来自 Hugging Face,推理引擎使用 llama.cpp(GGUF 格式),在 Apple 芯片的 Mac 上还可使用 Apple 的 MLX。
应用内还可以启动本地 API 服务器(默认地址为 http://localhost:1234),支持兼容 OpenAI 和兼容 Anthropic 的端点。因此,可以把为 ChatGPT API 编写的应用,或 Codex、Claude Code、Cline、Kilo Code 等工具的连接目标切换为自己电脑上的模型。官方文档说明,与已下载的模型聊天或使用文档聊天时,输入的内容不会离开你的电脑。
LM Studio 个人使用和工作使用均免费(2025 年 7 月,工作使用需另行取得商用许可的条件已被取消)。此外,运营方还推出了以 AI 智能体身份完成任务的姊妹应用“LM Studio Bionic”,它提供使用云端开放模型的付费方案(Bionic+、Pro)。
使用方法
- 安装 从官方网站的“Download”获取适用于你的操作系统的安装程序。Linux 提供 AppImage 和 .deb 两种格式。
- 查找并下载模型 在“Discover”标签页中,从官方推荐中选择,或用“qwen”“gemma”等关键词搜索。同一个模型常有“Q4_K_M”“Q8_0”等多个版本,区别在于压缩程度(量化)不同。官方文档建议,如果电脑性能足够,选择 4 bit 及以上的版本。
- 加载模型并聊天 在“Chat”标签页中选择并加载模型后,即可在类似 ChatGPT 的界面中对话。还可以附加 .docx、.pdf、.txt 文件,针对其内容提问。
- 使用本地 API 服务器
在开发者界面启动服务器后,即可在
http://localhost:1234/v1使用兼容 OpenAI 的 API。只需把 OpenAI SDK 的连接地址(base URL)改为这里,就能从现有代码调用本地模型。 - 从终端操作(可选)
使用附带的 CLI“
lms”,可以执行lms get(下载模型)、lms ls(列表)、lms ps(已加载的模型)、lms server start(启动服务器)、lms chat(在终端中对话)等命令。
主要功能
01查找并运行模型
- 下载模型 — 可在应用内搜索并下载 Hugging Face 上受支持的模型,也可以粘贴 Hugging Face 的网址进行查找
- 两种推理引擎 — llama.cpp(GGUF)支持 Mac、Windows、Linux,Apple 芯片的 Mac 还能运行 MLX 模型
- 离线运行 — 下载模型后,聊天、使用文档聊天和本地服务器均可在没有网络连接的情况下使用
- 并行处理多个请求 — llama.cpp 引擎可将多个请求合并并行处理(默认最多 4 个)
02聊天
- 使用文档聊天(RAG) — 附加的文档较短时会把全文交给模型,较长时则检索相关部分。所有处理都在电脑内完成
- 支持 MCP — 可添加 MCP 服务器(本地或远程),让模型使用外部工具
- 预设 — 可保存系统提示词和生成设置,并导入或分享
03面向开发者
- 本地 API 服务器 — 提供兼容 OpenAI 的端点(`/v1/chat/completions`、`/v1/responses`、`/v1/embeddings` 等)、兼容 Anthropic 的端点(`/v1/messages`)以及自有的 REST API。也可以设置为必须认证
- SDK 和 CLI — 提供 TypeScript(lmstudio-js)和 Python(lmstudio-python)SDK,CLI“lms”以 MIT 许可证开源
- llmster — 无需图形界面即可运行的后台守护程序版本,可在服务器、云端或 CI 环境中使用 LM Studio 的功能
- LM Link(预览) — 通过加密连接(基于 Tailscale),像使用本地模型一样使用家中或公司另一台电脑上运行的模型
价格
LM Studio 本体免费,无论个人使用还是工作使用,都不需要申请或商用许可。在电脑上运行模型的功能(包括聊天和本地服务器)不收取费用。
有付费方案的是姊妹应用 LM Studio Bionic,在使用云端运行的开放模型时收费。价格以美元计价,依据 2026 年 10 月 10 日官方价格页面的标示。
| 方案 | 价格 | 主要内容 |
|---|---|---|
| Free | 0 美元 | Bionic 的智能体功能、运行本地模型(llama.cpp、MLX)、离线语音转写、LM Link(最多 5 台设备)、次数有限的网页搜索 |
| Bionic+ | 每月 20 美元 | 包含 Free 的全部内容,另有托管在美国的开放模型(Kimi K3、GLM 5.3、DeepSeek V4 Flash 等)、折扣购买 token、网页搜索与页面提取 |
| Pro | 每月 100 美元 | 包含 Bionic+ 的全部内容,另有 5 倍的使用上限、新功能抢先体验 |
积分机制:使用云端模型时,会根据模型和处理的 token 数消耗积分。超出方案所含用量的部分,由购买的积分支付。本地模型和通过 LM Link 使用的模型不消耗积分,没有 LM Studio 账号也能使用。面向团队,可在组织内统一结算积分费用;面向团队的订阅方案标示为“即将推出”(确认时)。
LM Studio 与 LM Studio Bionic 的区别
| LM Studio | LM Studio Bionic | |
|---|---|---|
| 定位 | 运行本地 LLM 的应用(聊天界面和 API) | 面向开放模型的 AI 智能体 |
| 主要用途 | 试用和比较模型、细致设置、为应用提供 API | 创建和编辑文档、编程、调研、自动化 |
| 可用模型 | 本地模型、通过 LM Link 的模型 | 本地模型、通过 LM Link 的模型、云端开放模型 |
| 价格 | 免费 | Free 0 美元/Bionic+ 每月 20 美元/Pro 每月 100 美元 |
官方文档说明,Bionic 是与 LM Studio 相互独立的应用,需要进行底层细致设置时,可以在使用 Bionic 的同时继续使用 LM Studio。启用 Bionic 的编程功能后,它可以在指定的文件夹中编辑文件、进行 Git 操作并执行 shell 命令。
运行所需环境
- macOS — Apple 芯片(M1~M4)的 Mac,需 macOS 14.0 及以上。建议内存 16GB 以上(8GB 的 Mac 在使用小模型和较短上下文时也可能可用)。不支持 Intel 芯片的 Mac。
- Windows — 支持 x64 和 ARM(Snapdragon X Elite)。x64 需要支持 AVX2 指令集的 CPU。建议内存 16GB 以上、GPU 专用显存 4GB 以上。
- Linux — 支持 x64 和 ARM64。以 AppImage 分发(也提供 .deb),需要 Ubuntu 20.04 及以上。
- 模型容量 — 单个模型从几 GB 到几十 GB 以上不等。模型越大,所需内存越多。
日语支持
- 应用界面 — 可在设置的“Language”中选择日语(由社区翻译者翻译)。打开设置界面需要将显示模式设为 Power User 及以上。
- 官方网站和文档 — 为英语。
- 用日语对话 — 能否使用日语取决于模型。选择 Qwen、Gemma 等支持多语言的模型,即可用日语交流。
- 价格(Bionic) — 以美元计价,没有日元标价。
优点与缺点
优点
- 个人和工作使用均免费,与已下载模型的交互不会离开电脑
- 从查找模型到聊天都在界面中完成,即使不熟悉命令行也容易尝试本地 LLM
- 应用界面可显示为日语
- 提供兼容 OpenAI 和兼容 Anthropic 的 API,可将现有应用和编程工具的连接目标切换为本地模型
- 可以在界面上细致选择量化版本和加载设置,便于比较多个模型
缺点
- 要流畅运行,需要内存充足的电脑或高性能 GPU
- 无法在 Intel 芯片的 Mac 上使用
- 应用本体并非开源(开源的是 CLI lms 和 SDK)
- 智能体功能和云端模型在另一款应用(Bionic)中,其云端付费方案以美元计价,原则上不退款
口碑与评价
LM Studio 作为以图形界面运行本地 LLM 的应用广为人知,运营方的博客称其在全球已被下载数百万次,并已在数十家企业中部署。在本站介绍的 Cline、Kilo Code 页面中,LM Studio 也作为本地模型的连接目标出现。与以命令操作的 Ollama 相比,LM Studio 的特点是查找模型、对话和设置都在界面中完成,适合初次尝试本地 LLM 的人,或想一边比较量化版本一边挑选的人。另一方面,与其他本地运行工具一样,根据电脑性能,大型模型可能无法运行或运行缓慢。
常见问题(FAQ)
Q. LM Studio 可以免费使用吗? A. 可以。LM Studio 本体在个人使用和工作使用上均免费。有付费方案的是姊妹应用 LM Studio Bionic,使用云端模型时需支付 Bionic+(每月 20 美元)等费用。
Q. 可以在公司使用吗? A. 自 2025 年 7 月起,工作使用也已免费,不再需要联系运营方或取得商用许可。对于需要 SSO、模型使用限制等功能的组织,另有面向企业的方案。
Q. 可以用日语使用吗? A. 应用界面可以在设置中切换为日语。选择 Qwen、Gemma 等支持日语的模型,即可用日语对话。官方网站和文档为英语。
Q. 输入的内容会被发送到外部吗? A. 官方文档说明,与已下载的模型聊天或附加文档聊天时,输入的内容和文档不会离开你的电脑。在 Bionic 中使用云端模型时,会在美国的服务器上处理,官方明确表示不保存提示词和回复。
Q. Ollama 和 LM Studio 有什么区别? A. 两者都是在本地运行开放模型的工具,但 Ollama 以命令为主,LM Studio 则是在界面中查找模型、对话和设置的应用。LM Studio 也有 CLI(lms),两者都提供兼容 OpenAI 的 API。
Q. Mac 上可以使用吗? A. 在 macOS 14.0 及以上的 Apple 芯片(M1~M4)Mac 上可以使用。不支持 Intel 芯片的 Mac。
Q. 取消 Bionic 的付费方案后会退款吗? A. 使用条款规定,除法律要求或另有明示外,费用不予退还。可随时取消,取消在当前计费周期结束时生效(2026 年 10 月 10 日时)。
与其他 AI 工具的区别
| 服务 | 类型 | 适合的用法 |
|---|---|---|
| LM Studio | 运行本地 LLM 的桌面应用(图形界面+API) | 想通过界面查找并试用模型、想把应用的连接目标设为本地 LLM |
| Ollama | 本地 LLM 运行工具(以 CLI 为主)+云端推理 | 想用命令运行模型、想嵌入到服务器中 |
| Hugging Face | 模型和数据集的共享平台 | 想查找并获取各种模型、想发布自己的模型 |
| Cline | 在 VS Code 中运行的编程智能体 | 想连接 LM Studio 等的模型来编写代码 |
Qwen 和 DeepSeek 是“模型”,Hugging Face 是分发和共享模型的“场所”,LM Studio 和 Ollama 则是在本地运行这些模型的“运行环境”。
本页信息截至 2026 年 10 月 10 日,依据 LM Studio 官方网站(首页、价格页面、下载页面、LM Link、Enterprise、使用条款、官方博客)和官方文档(LM Studio、Bionic、开发者文档、系统要求、显示语言)。价格和功能可能会变更,最新信息请查看官方网站。
