Metadata-Version: 2.4
Name: qwen38-27b
Version: 0.1.2
Summary: 一键运行 Qwen3.8-27B-MTP 本地大模型：自动装环境、下模型、进对话
License: MIT
Requires-Python: >=3.9
Description-Content-Type: text/markdown
Requires-Dist: requests>=2.31
Requires-Dist: rich>=13.7

# qwen38-27b

在本地一键运行 Qwen3.8-27B-MTP（q4_K_M，约 16.8GB）：自动装环境、下模型、进对话。**已存在的模型（Edmund 引擎目录 / Ollama 缓存）和运行时会直接复用，不重复下载。**

## 使用

```bash
uvx qwen38-27b                 # 一键：交互式对话
uvx qwen38-27b --say "你好"     # 单发一句
```

模型来自 Ollama 官方 registry（`qwen3.8:27b-mtp-q4_K_M`），无需登录；运行时复用系统/Edmund 自带的 llama-server，缺了会自动用 Homebrew 安装 llama.cpp。Apple Silicon 上默认全量 Metal 加速（实测 M5 Pro 约 13 tok/s）。

交互命令：`/exit` 退出，`/clear` 清空上下文，`/save 文件` 保存对话。

## 常用选项

| 参数 / 环境变量 | 说明 |
|---|---|
| `--model PATH` / `QWEN38_27B_MODEL` | 指向模型 GGUF 文件，跳过查找与下载 |
| `--server-bin PATH` / `QWEN38_27B_LLAMA_SERVER` | 指定 llama-server 二进制 |
| `--port 8081` / `--ctx 16384` / `--ngl 99` | 端口 / 上下文 / GPU 层数（默认全 Metal） |

路径在首次就绪后写入 `~/.qwen38-27b/config.json`，后续启动直接复用。

姊妹包：[qwen38-flash-next](https://pypi.org/project/qwen38-flash-next/)（125B MoE 版本）。
