喂“语料”让大模型学习你的专属知识。

5分钟搞定!直接上车大模型语料投喂#极简教程#

  • 一、准备

1.安装AnythingLLM,官网下载,建议安装非C盘,很占空间。

(这里以Ollama部署大模型Deepseek-R1为例。不清楚的可以看之前教程https://blog.csdn.net/ysxlm/article/details/145848356。)

2. 语料:整理需投喂文档,优先选择TXT、Markdown(MD)格式,结构化数据可选CSV;不要用扫描版PDF、带复杂格式Word。

3. 配置AnythingLLM:关键 。

点击左下角“扳手”图标进入设置,将“人工智能提供商”菜单下面“大语言模型LLM”和“ 嵌入器”两个子菜单,都选为Ollama,和你下载模型(如Deepseek-R1),返回保存。

二、投喂语料

1:创建专属工作区

AnythingLLM主界面,点击“新建工作区”,输入便于管理名称(“XX知识库”)。

再点击工作区右侧的齿轮图标,确认“聊天设置”已选中Ollama对应模型,点击“更新工作区”或“update”保存。

2:上传投喂

工作区名字右边找到“上传”的图标,再选择语料文档上传,再点击“移动到工作区”, 再点击“保存并嵌入”。

 文档多很慢很慢很慢(在“Processing Queue”查进度)

三、大功告成

我们就可以用ChatBox中的对话框开始使用,输入与语料相关的问题,若下方显示“引用”标识就ok。

提醒技巧:

参数优化:若出现回答不准确,可调整工作区设置里的“文档相似度阈值”(设为“无限制”)或“上下文片段数量”(从默认4调整为6),优化检索范围。

批量投喂:多份语料可打包为ZIP文件批量上传,系统会自动批量处理,提升效率。

拆分投喂:若语料文档较大,可拆分為短段落,提升解析效果。

Logo

魔乐社区(Modelers.cn) 是一个中立、公益的人工智能社区,提供人工智能工具、模型、数据的托管、展示与应用协同服务,为人工智能开发及爱好者搭建开放的学习交流平台。社区通过理事会方式运作,由全产业链共同建设、共同运营、共同享有,推动国产AI生态繁荣发展。

更多推荐