紧随 RC1 之后,此版本修复了一个依赖问题,并新增了两项实用功能:

  • 未设置默认模型的用户,其默认模型现已更新为 GPT-5.6 Luna。此前默认模型为 GPT-4o mini。Luna 是一款更优秀且更新的模型,但费用略高——输入每百万 token $0.20,输出每百万 token $1.20,而 4o mini 的费用为 $0.15/$0.60。您可以使用 llm models default gpt-4o-mini 切换回 4o mini,或使用 llm models default gpt-5-nano 切换至更便宜的默认模型 GPT-5 nano($0.05/$0.40)。#1576
  • 新增 llm openai endpoint 命令,用于针对任意 OpenAI 兼容端点运行提示、聊天和模型列表查询,无需先配置模型。这些调用不会被记录。#1565

llm openai endpoint 命令非常酷。我曾对缺乏一个明显的 CLI 工具来尝试针对任意 OpenAI Chat Completions 仿真端点运行提示感到沮丧,因此决定将其添加到 LLM 本身。

使用此功能甚至无需安装 LLM。以下是使用 uvx 一行命令运行提示(含工具)的示例,针对 LM Studio 本地模型:

uvx --pre llm openai endpoint http://127.0.0.1:1234/v1 \
  T llm_version -T llm_time --td \
  -m google/gemma-4-31b 'what is the current LLM version? And the time?'

输出示例