当前位置:首页 > AI技术 > 正文内容

WorkBuddy 怎么用DeepSeek WorkBuddy 接入DeepSeek模型教程实战最佳实践|Duuu笔记

admin4个月前 (03-30)AI技术103

需完成模型适配、API桥接与配置验证三类操作:一、部署DeepSeek模型并暴露HTTP接口;二、在WorkBuddy AI中配置OpenAI兼容的自定义模型参数;三、调整提示词模板与消息分隔符;四、启用流式传输以保障多轮对话上下文;五、通过Nginx反向代理清洗非标准响应。

如果您希望在WorkBuddy AI中接入DeepSeek模型以实现本地化或私有化的大语言模型调用,则需完成模型适配、API桥接与配置验证三类核心操作。以下是具体实施步骤:

一、确认DeepSeek模型部署环境

WorkBuddy AI本身不内置DeepSeek模型,需先在本地或服务器端完成DeepSeek-R1或DeepSeek-Coder等对应版本的模型加载与服务暴露。该步骤确保后续WorkBuddy AI能通过标准HTTP接口访问推理能力。

1、从DeepSeek官方GitHub仓库下载指定版本的模型权重文件(如

deepseek

-

ai

/

deepseek

-coder-1.3b-base)。

2、使用vLLM、llama.cpp或Transformers+FastAPI搭建推理服务,启动后监听端口如http://127.0.0.1:8000/v1/chat/completions。

3、使用curl命令验证服务可用性:

curl -X POST http://127.0.0.1:8000/v1/chat/completions -H "Content-Type: application/json" -d '{"model":"

deepseek

-coder-1.3b","messages":[{"role":"user","content":"Hello"}]}'

二、配置WorkBuddy AI的自定义LLM接入参数

WorkBuddy AI支持通过“设置→AI模型→添加自定义模型”路径注入外部大模型API,需严格匹配OpenAI兼容接口规范,否则将触发404或500错误。

1、打开WorkBuddy AI客户端,进入【设置】菜单,点击【AI模型】选项卡。

2、点击右下角【+ 添加模型】按钮,在弹出表单中填写:模型名称填

DeepSeek-Coder-1.3b

,API基础地址填

http://127.0.0.1:8000/v1

,API密钥留空(若服务未启用鉴权)。

3、在“模型ID”字段中输入与推理服务返回header中一致的模型标识,例如

deepseek

-coder-1.3b-base

,该值必须与vLLM启动时--model参数完全相同。

三、替换系统默认提示词模板

DeepSeek模型对system角色指令敏感度高于Llama系列,若沿用默认模板可能导致响应格式错乱或拒绝生成。需手动调整prompt schema以匹配DeepSeek训练时的对话结构。

1、在模型配置页点击【高级设置】展开区域。

Zeemo

提供视频字幕、字幕制作和字幕翻译服务

下载

2、将“系统提示词模板”字段内容替换为:

You are a helpful programming assistant based on DeepSeek-Coder. Respond only in English unless explicitly asked for another language.

3、将“用户/助手消息分隔符”设为

\n\n

,禁用“添加system角色到请求体”选项(因部分DeepSeek部署不支持system字段)。

四、测试多轮对话上下文保持能力

DeepSeek-R1具备较强长上下文理解能力,但WorkBuddy AI默认会截断超过4096 token的历史记录。需手动启用流式传输与增量缓存机制保障对话连贯性。

1、新建一个代码分析任务窗口,输入问题:“请分析以下Python函数是否存在内存泄漏风险”,随后粘贴一段含闭包与全局变量的代码。

2、发送后观察响应延迟与token计数器,若显示

streaming: true

且响应分块返回,则说明WebSocket连接已生效。

3、紧接着追加提问:“基于刚才的分析,给出修复建议并重写函数”,验证历史上下文是否被正确注入至新请求的messages数组中。

五、处理常见响应解析异常

当WorkBuddy AI收到DeepSeek服务返回的非标准JSON(如含ANSI颜色码、多余换行或字段名大小写不一致)时,前端会抛出parse error。此时需在反向代理层做标准化清洗。

1、在Nginx配置中添加location /v1/段落,启用proxy_pass转发至本地vLLM服务,并插入header过滤规则。

2、添加sub_filter指令移除响应体中的控制字符:

sub_filter '\x1b\[.*?m' '';

3、启用json_filter模块,强制将response body中所有key转为小写,确保WorkBuddy AI解析器可识别choices、message、content等字段。

相关文章

一文讲清神经网络、BP神经网络、深度学习的关系

人工神经网络中的顶级代表。往往说《神经网络》就是指《BP神经网络》。 大家研究着各种神经网络,研究得不亦乐乎, 来了两个家伙Romelhart 和Mcclelland,...

前端开发高级应用:Minimax视频生成提示词中文还是英文好实战案例|Duuu笔记

优先使用英文提示词,因其更契合模型训练语料并能稳定触发视觉特征;其次可采用中英混合策略兼顾文化专有名词;纯中文适用于强本土化场景;最终需通过多指标对比验证最优语言形式。 ☞☞☞AI 智能聊天, 问答...

深入理解前端开发:零基础教程:怎么用 Gemini 自动生成短视频脚本与拍摄大纲完全指南|Duuu笔记

需明确输入指令、理解输出逻辑并合理拆解内容:一、构建含角色/任务/格式等要素的提示词;二、追加分镜与时间轴约束优化专业性;三、转译为带道具编号与颜色标记的执行清单;四、用Gemini校验注意力断点并迭...

前端开发实战详解:骡子快跑如何生成会议纪要 骡子快跑语音转文字整理技巧最佳实践|Duuu笔记

使用听脑AI转写、骡子快跑生成纪要、影子跟读校验、自定义术语词典及EcomGPT-CNN情绪风险分析,五步实现会议纪要高效精准产出。 ☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量...

前端开发高级应用:基础全攻略:教你玩转 Gemini 对话、写作与分析的三大秘籍实战案例|Duuu笔记

提升Gemini使用效能需践行三大路径:一、精准构建提示词,明确任务类型、输出格式与背景信息;二、分层拆解写作任务,依大纲、扩展、风格、校验四步迭代;三、结构化驱动分析,指定维度、标准与溯源要求。...

前端开发实战详解:MuleRun如何分享Agent MuleRun Agent分享链接生成教程最佳实践|Duuu笔记

需通过生成专属链接分享MuleRun平台中的Agent:先登录并进入Agent编辑页,启用Public Sharing后生成https://mulerun.com/share/开头的唯一链接,可选设A...

发表评论

访客

看不清,换一张

◎欢迎参与讨论,请在这里发表您的看法和观点。