拓冰建站拓冰建站
首页 / 资讯中心 / 正文

AI进行小说续写创作

本文介绍如何在本地环境搭建一个小说续写的环境采用Opencode 云平台部署私有模型的方式来进行。部署私有模型在本地环境或在云平台上租用GPU资源部署私有模型。主要是考虑到性价比以及减少公有模型对小说题材内容等各方面的限制。这里选用的是Modelscope的Limu520/Huihui-Qwen3.8-27B-abliterated-UD-Q4_K_XL模型。下载之后采用llama.cpp推理框架来进行部署。运行以下命令安装llama.cppcurl -LsSf https://llama.app/install.sh | sh然后运行以下命令来启动模型服务llama serve \ -m /path/Qwen3.8-27B-abliterated-UD-Q4_K_XL/Huihui-Qwen3.8-27B-abliterated-UD-Q4_K_XL.gguf \ -md /path/Qwen3.8-27B-abliterated-UD-Q4_K_XL/Qwen3.8-27B-DFlash2-Q4_K_M.gguf \ --spec-type draft-dflash \ --spec-draft-n-max 7 \ -ngl 99 -ngld 99 \ -fa on \ --jinja \ --host 0.0.0.0 \ --port 8888 \ --alias qwen3.8-27b \ --ctx-size 131072 \ --cache-type-k q8_0 \ --cache-type-v q8_0 \ --reasoning-budget 0这里除了加载主模型外还加载了DFLASH模型这个模型提供了推测解码的功能通过小模型打草稿大模型验证的方式加快Token生成的速度。这里面ctx-size是控制上下文长度在我采用的5090 32G显卡这个长度是一个比较合适的数值。模型服务运行后能稳定提供大约50 Token/s的速度。opencode运行配置好模型之后就可以在Opencode里面添加该模型只要在Opencode的对话窗口里提供模型访问地址让其自动添加即可。另外还需要让opencode安装opencode-novel-plugin这个插件这个插件提供了3个专用Agent、7个工具、5个Skill含武侠专项覆盖从故事概念到成稿的完整工作流。它明确对武侠小说创作有专门优化并融合了“优先级分层上下文P0/P1/P2”等机制。安装后通过/novel-init等命令启动。最后在Opencode里面指定要参考的小说让其按照风格来创作或者进行续写等即可。
分享:

看完干货,该让你的企业上线了

免费需求沟通 · 48 小时内出具建站方案 · 河南本地可上门