预览版推出:LM Link立即开始

LM Studio 0.3.23

2025年8月12日·

📣 错过请看:LM Studio 现已免费用于工作!阅读更多 https://lm-studio.cn/blog/free-for-work

LM Studio 0.3.23 稳定版现已发布。此版本重点提升了可靠性、低配设备的运行性能,并修复了一些错误。


提升聊天中 openai/gpt-oss 工具调用的可靠性

在发送给模型之前,工具名称现在会进行统一格式化。此前,名称中带有空格的工具会使 gpt-oss 产生混淆并导致工具调用失败。现在工具名称会被转换为 snake_case(蛇形命名法)。

此外,我们解决了一些以前可能导致聊天中解析错误的 Bug。您可能会注意到工具调用的可靠性有了显著提升。

通过 Chat Completions 接口获取 gpt-oss 的推理内容

与 0.3.22 版本相比,此行为有所变化。

  • message.content 将不再包含推理内容或 <think> 标签。
  • 推理内容现在位于 choices.message.reasoning(非流式)和 choices.delta.reasoning(流式)中。
  • 这与 o3-mini 的行为一致。

强制将 MoE 专家权重置于 CPU 或 GPU

在此版本中,我们添加了一个高级模型加载设置,可将所有 MoE 专家权重放置到 CPU 或 GPU(默认)上。

开启此选项可强制将 MoE 专家权重置于 CPU 上。低显存(VRAM)设备可以尝试此操作

如果您的显存不足以将整个模型卸载到 GPU 专用显存中,这将非常有用。如果是这种情况,请尝试在高级加载设置中开启 “Force Model Expert Weights onto CPU”(强制将模型专家权重置于 CPU)选项。

如果能够将整个模型完全卸载到 GPU 显存中,那么最好保持默认选项,即将专家权重也放置在 GPU 上。

这利用了与 llama.cpp--n-cpu-moe 相同的底层技术。

请注意,您可以进行持久化的单模型设置。详情请参阅 文档

LM Studio 0.3.23 - 完整发布说明

通过应用内更新进行升级,或前往 https://lm-studio.cn/download 下载。

版本 3

  • [llama.cpp][MoE] 支持在高级加载设置中通过 “Force Model Expert Weights onto CPU” 将专家权重卸载到 CPU/GPU 内存/显存
  • 在提供给模型之前规范化工具名称(替换空格、特殊字符)

版本 2

  • 修复下载官方推荐模型时,“Complete Download”(完成下载)按钮有时不起作用的问题
  • 修复扩展包(如 Harmony)的 “Fix”(修复)按钮无法工作的问题
  • 修复向 /v1/chat/completions 发送某些包含工具的请求时,出现 “Cannot read properties of undefined (reading 'properties')” 错误的问题
  • 修复自动更新 harmony 时出现 Error: EPERM: operation not permitted, unlink 错误的问题

版本 1

  • 修复了多个 Bug,从而显著提升了聊天中工具调用的可靠性
  • 修复了部分旧对话无法在应用中加载的 Bug
  • 修复了在非流式模式下通过兼容 OpenAI 的 API 使用工具调用时,有时会失败的 Bug
  • 修复模型在 v1/chat/completions 中不输出 thinking 标签的问题
    • 对于 gpt-oss
      • message.content 将不包含推理内容或特殊标签
      • 这与 o3-mini 的行为一致。
      • 推理内容将位于 choices.message.reasoning (stream=false) 和 choices.delta.reasoning (stream=true) 中
  • 修复在装有 AMD+NVIDIA 显卡的机器上,由于 “TypeError: Invalid Version” 导致应用功能异常的问题
  • 修复了在用户模式下 MCP 插件芯片名称无法渲染的 Bug
  • 修复了点击时搜索结果会刷新的 Bug

资源

© . This site is unofficial and not affiliated with Element Labs, Inc.