把模型文件夹放进这个 models/ 目录，软件点「刷新模型」即可识别。文件夹里要包含以下之一：
1) model.json   —— 写明类型与启动命令（推荐）
2) model.exe    —— 直接当成外部模型运行
3) model.py / main.py / run.py —— 用 python 运行

model.json 支持两种类型：
- "type": "external"  本地程序模式：软件启动本文件夹里的程序（子进程），通过标准输入输出传对话、收回复。适合你自己写的推理程序、或 llama.cpp 编译出的 exe。command 不写默认 ["python","model.py"]。
- "type": "openai"    接口模式：指向一个 OpenAI 兼容接口。可以指向本机服务（如 "base_url": "http://localhost:11434/v1"，即本地 Ollama），也可以指向云端。需要 base_url / model，本地服务 api_key 可留空。

external 外部模型协议：软件向程序 stdin 发送 JSON {"prompt":...,"history":...,"model":...}，程序向 stdout 输出回复文本或 JSON {"reply":...}。
openai 接口模式协议：软件直接 POST 该接口的 /chat/completions（OpenAI 标准格式）。
支持任意语言写的模型（C / C++ / Python / JS 编译出的 exe 都行）。
