如何实现 Codex + 本地模型 Token 自由使用? 实测环境: RTX 5080 16G + 48G 内存 本地推理速度:58.03 t/s【很快】 流程如下: 1.在 HuggingFace 下载本地模型 Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive https://t.co/qlNXMzNzug 2.下载并配置 llama.cpp 3.写一个一键启动脚本 可以让 GPT LilTea @LilTea_eth · 2026-06-10