在本地部署Qwen3大模型与Dify环境中亲测制作“合同审查智能体”应用
在与多位律师朋友以及自己开公司的老板朋友聊天中发现,他们都有一个迫切的需求:“希望对自己手头的大量合同文本,做一个全面的合同风险评估,提前采取措施规避风险点,或者提前准备以应对风险的爆发,并减少损失。”因此,在私有化部署的大模型与AI应用开发平台中开发本地可用的“合同审查智能体”,就像给企业装了一个既聪明又可靠的“法律秘书”。
想象一下,公司的合同就像家里的贵重物品。如果使用网上的大模型和类似DeepSeek、豆包等AI助手,虽然方便,但总担心数据泄密。私有化部署相当于把合同锁进自家保险柜(企业本地服务器,甚至就是一台配了独立显卡的笔记本电脑),钥匙只有自己保管。这能有效避免合同里的客户隐私或商业机密数据泄露的风险,还能满足像GDPR这种“国际防盗锁”的合规要求。
况且,每个企业的合同审核需求不同,就像不同病人需要不同的药方。通过Dify的工作流功能,企业可以像搭积木一样定制审核流程。比如:像“预检分诊”一样挑出合同里的问题条款,引用法律条文,并给出专业化修改建议;还能让系统自动翻译合同,为中小外贸企业提升效率。当然,AI存在“幻觉”问题,适当的人工复核是必要的。
接下来,我们就看看通过Ollama软件本地部署并运行Qwen3(30b多模态版本:300亿模型参数量),配合本地Docker容器环境运行的Dify软件,来快速开发一个“合同审查智能体”。
一、智能体开发环境:
老规矩,说一下环境的版本号:
本地模型运行环境:Ollama v0.7.0版本(从0.6.8版本在线升级);
本地推理模型:qwen3:30b(因为Ollama0.6.8版本不兼容刚推出的qwen3:30b-a3b-q4_K_M模型版本,害得我还消耗流量重新下载了19GB模型一遍);
智能体开发运行环境:Dify v1.3.1;(写本文时,v1.4.0已经在推送了,但先不忙升级,让子弹再飞一会儿)
二、准备测试用途合同样本
特别注意啊,智能体能检测的合同文档格式如下:

文档中的主体都是虚构的名称,如有雷同,纯属巧合。
三、Dify中安装插件“Markdown转换器”

光看“Markdown转换器”的介绍,大家肯定会疑惑:“不是都建议把其他格式转成Markdown格式,以便于大模型理解吗?为何要把Markdown格式转为pptx、word等其他格式呢?”其实“Markdown转换器”(v1.2)是用在输出大模型的结论文本,输出为便于人类阅读和存档用途,就是最后的输出内容以pdf和word文档的格式提供下载。
四、Dify中创建工作流应用
首先在Dify中创建一个“空白应用”,选择“工作流”模式。
1、开始节点的设置
开始节点的“输入字段”位置添加4个变量作为下一个节点的输入:
(1).“文件列表”变量:“字段类型”选择“文件列表”,变量名称只能用英文和数字,随便起个名叫“upload”,显示名称可以用中文,就叫“文件列表”。此处用于上传合同文件本身。
(2).“审查主体”变量:“字段类型”选择“文本”,变量名称叫“Apart”,显示名称叫“审查主体”。此处让大模型知道要站在合同中哪一方的立场去分析问题规避风险。
(3).“工作领域”变量:“字段类型”选择“文本”,变量名称叫“workfiled”,显示名称“工作领域”。此处让MoE多模态大模型知道调用哪个内置专家来解决问题。
(4).“合同要点”变量:“字段类型”选择“文本”,变量名称叫“attention”,显示名称“合同要点”。此处是说本次合同文本的分析要重点关注哪些问题。
这4个方面的输入应该涵盖合同审查时最关键的四个方面的注意事项。
文件列表变量截图:

审查主体变量截图:

工作领域变量截图:

合同要点变量截图:

这里有个坑,Dify里面节点的“文本”变量的“最大长度”默认设置为48(意味着输入的文本Tokens字数不能超过48)。而合同文本一般较长,我就碰见个坑,默认48,读取合同时系统报错,这里修改为最大值“256”。
2、下一节点“LLM”的设置
LLM主要对合同审核要点进行解释,翻译为大模型能够理解的机器语言,此处填写到“SYSTEM”中的提示词如下:
“{{开始节点的attention}}将用户的要求或关注点转换为具体的合同审查要点,并输出为提示词中的attention”

此处注意:提示词最前面的函数是输入“{”大括号或者“/”斜杠来引入的。主要是提取开始节点的“合同要点”变量,作为Qwen3模型运算的输入值。
3、“文档提取器”提取合同文件内容
“文档提取器”节点在输入变量位置选择提取开始节点的“文件列表”变量,主要是提取上传的合同文件内容。

特别注意,“文档提取器”支持的文件上传格式为:txt、markdown、mdx、pdf、html、xlsx、xls、docx、csv、vtt、properties、md、htm。我选择上传docx文档。
4、下一节点“LLM2”的设置
这是主流程处理节点,在“上下文”处提取“LLM节点的输出函数,并在SYSTEM输入提示词如下:
角色:
你是一位专业的律师,执业领域是{{开始节点的workfiled}}
任务:
你要以{{开始节点的Apart}}利益最大化为原则,对{{上下文}}进行审查和分析,并提供严格的评分。具体目标:
1.对提交的合同文本进行全面审查,指出存在的问题和风险;
2.提供具体的改进建议,帮助改进和完善合同条款;
3.根据法律规范和个人建议,修改并完善合同的具体条款:
4.向客户提供专业的法律服务和支持。
约束条件:
1.必须遵守现行有效的法律法规,不能引用已废止的法律条文;
2.所有合同条款的设计应当符合最新的法律法规及相关政策的规定,要使用准确无误的专业术语和地名:
3.结合特定行业的特点(如XXX行业),确保合同内容贴合实际情况。
4,考虏并反映 {{开始节点的Apart}}的需求,始终站在其角度满足利益最大化。

这个“上下文”,是打一个英文的{,这样就能引用出来了。
5、将输出内容进行“Markdown转换pdf”的设置
从LLM2添加下一个节点,选择工具,下一步选择markdown转换器节点:

第一个“Markdown转换pdf”节点设置如下:

第二个“Markdown转换docx”节点设置如下:

都是将“LLM2节点的输出内容作为最终分析报告的内容填入PDF和WORD文档中。
6、添加结束节点,并设置变量:

结束节点需添加3种输出,一个是“审核结果”直接输出文字,另外两个分别输出为PDF文档和WORD文档,可以下载。
dify创建工作流“合同审查智能体”到这边就结束了。
五、运行测试
开始测试时,需要分别输入4种变量。
“合同要点”输入为:“重点关注合同主体合法性与授权范围的潜在风险,服务范围需要明确,避免模糊条款,以及约定服务范围变更的流程与机制”
审查主体:噼里啪啦云
工作领域:软件服务
报错:

在“文档提取器”这里报错,说有非结构化的在upload里面。检查后,是“文档提取器”本身不支持.doc文件的提取。需要变更上传的文档格式为.docx!
经上述修改后,该dify应用流程运行成功。获得期望输出:

运行结束后可以下载相应的文件查看效果。
输出的docx格式和pdf格式内容一致,界面截图如下:

Dify中整个智能体开发流程截图如下:

我的文章里面配的一步一步操作的截图比较多,内容稍微偏浅显易懂一点,主要是考虑到“工具就是拿来用的,越多普通人知道如何使用,才能提高效率”,会更多照顾到普通人的理解水平。各位技术大拿可忽略……
喜欢本文的朋友请“点赞+转发+推荐”
有问题请留言,咱们评论区聊
请关注并订阅本公众号“架构面面观”
想入门 AI 大模型却找不到清晰方向?备考大厂 AI 岗还在四处搜集零散资料?别再浪费时间啦!2025 年 AI 大模型全套学习资料已整理完毕,从学习路线到面试真题,从工具教程到行业报告,一站式覆盖你的所有需求,现在全部免费分享!
👇👇扫码免费领取全部内容👇👇

一、学习必备:100+本大模型电子书+26 份行业报告 + 600+ 套技术PPT,帮你看透 AI 趋势
想了解大模型的行业动态、商业落地案例?大模型电子书?这份资料帮你站在 “行业高度” 学 AI:
1. 100+本大模型方向电子书

2. 26 份行业研究报告:覆盖多领域实践与趋势
报告包含阿里、DeepSeek 等权威机构发布的核心内容,涵盖:
- 职业趋势:《AI + 职业趋势报告》《中国 AI 人才粮仓模型解析》;
- 商业落地:《生成式 AI 商业落地白皮书》《AI Agent 应用落地技术白皮书》;
- 领域细分:《AGI 在金融领域的应用报告》《AI GC 实践案例集》;
- 行业监测:《2024 年中国大模型季度监测报告》《2025 年中国技术市场发展趋势》。
3. 600+套技术大会 PPT:听行业大咖讲实战
PPT 整理自 2024-2025 年热门技术大会,包含百度、腾讯、字节等企业的一线实践:

- 安全方向:《端侧大模型的安全建设》《大模型驱动安全升级(腾讯代码安全实践)》;
- 产品与创新:《大模型产品如何创新与创收》《AI 时代的新范式:构建 AI 产品》;
- 多模态与 Agent:《Step-Video 开源模型(视频生成进展)》《Agentic RAG 的现在与未来》;
- 工程落地:《从原型到生产:AgentOps 加速字节 AI 应用落地》《智能代码助手 CodeFuse 的架构设计》。
二、求职必看:大厂 AI 岗面试 “弹药库”,300 + 真题 + 107 道面经直接抱走
想冲字节、腾讯、阿里、蔚来等大厂 AI 岗?这份面试资料帮你提前 “押题”,拒绝临场慌!

1. 107 道大厂面经:覆盖 Prompt、RAG、大模型应用工程师等热门岗位
面经整理自 2021-2025 年真实面试场景,包含 TPlink、字节、腾讯、蔚来、虾皮、中兴、科大讯飞、京东等企业的高频考题,每道题都附带思路解析:

2. 102 道 AI 大模型真题:直击大模型核心考点
针对大模型专属考题,从概念到实践全面覆盖,帮你理清底层逻辑:

3. 97 道 LLMs 真题:聚焦大型语言模型高频问题
专门拆解 LLMs 的核心痛点与解决方案,比如让很多人头疼的 “复读机问题”:

三、路线必明: AI 大模型学习路线图,1 张图理清核心内容
刚接触 AI 大模型,不知道该从哪学起?这份「AI大模型 学习路线图」直接帮你划重点,不用再盲目摸索!

路线图涵盖 5 大核心板块,从基础到进阶层层递进:一步步带你从入门到进阶,从理论到实战。

L1阶段:启航篇丨极速破界AI新时代
L1阶段:了解大模型的基础知识,以及大模型在各个行业的应用和分析,学习理解大模型的核心原理、关键技术以及大模型应用场景。

L2阶段:攻坚篇丨RAG开发实战工坊
L2阶段:AI大模型RAG应用开发工程,主要学习RAG检索增强生成:包括Naive RAG、Advanced-RAG以及RAG性能评估,还有GraphRAG在内的多个RAG热门项目的分析。

L3阶段:跃迁篇丨Agent智能体架构设计
L3阶段:大模型Agent应用架构进阶实现,主要学习LangChain、 LIamaIndex框架,也会学习到AutoGPT、 MetaGPT等多Agent系统,打造Agent智能体。

L4阶段:精进篇丨模型微调与私有化部署
L4阶段:大模型的微调和私有化部署,更加深入的探讨Transformer架构,学习大模型的微调技术,利用DeepSpeed、Lamam Factory等工具快速进行模型微调,并通过Ollama、vLLM等推理部署框架,实现模型的快速部署。

L5阶段:专题集丨特训篇 【录播课】

四、资料领取:全套内容免费抱走,学 AI 不用再找第二份
不管你是 0 基础想入门 AI 大模型,还是有基础想冲刺大厂、了解行业趋势,这份资料都能满足你!
现在只需按照提示操作,就能免费领取:
👇👇扫码免费领取全部内容👇👇

2025 年想抓住 AI 大模型的风口?别犹豫,这份免费资料就是你的 “起跑线”!
更多推荐


所有评论(0)