之前有许多用户向我们反馈,近几年,本地大模型实测,参数越高会越“聪明”这样一个情况,我们也和多个用户做过深度的交流,本地大模型,参数越高就越“聪明”这个情况呢确实存在,但是仅仅是针对同系列、同量化类型的模型而言的,比如deepseek R1_32B_FP16 肯定是比deepseek_R1_14B_FP16要“聪明”但是如果是deepseek R1_32B_Q4 那在某些场景下,就不一定比deepseek_R1_14B_FP16更“聪明”,这还仅仅是针对同系列对比,不同系列对比,例如数据结构化的效果,qwen-vl_7b的实际效果要远远好于deepseek R1_32b,不区分量化类型,当然,我们这半年里,测试了数百个小模型的不同量化类型,总结了许多切实可行的多小模型混用经验。
也就是说,不同的模型所具备的特殊能力不同,不能因为参数小就觉得不好用,既然这些量化后的模型存在,模型开发商也一直在推行,那就证明这些小模型有一定的价值和意义。
阮咸AI助手的一个核心思想就是用多个小模型混用去替代参数较大的模型,达到相近的效果。参数大,就意味着对本地算力的需求、硬件配置也高,动不动几十万上百万的硬件成本,推升了应用门槛,而阮咸AI助手,采用的多小模型混合利用的思想,能够把硬件成本降到几乎每个人都能用的起。
一.阮咸AI助手产品设计背景
1.从“技术门槛”到“零门槛”针对基层用户缺乏硬件部署经验、摸索成本高的痛点,阮咸AI助手实现了“即装即用”的极致体验。通过预设参数化配置,用户无需深厚的AI知识,即可根据不同场景快速适配模型,让离线本地大模型从实验室走向办公桌应用。
2. 从“算力瓶颈”到“资产活化”针对大模型对硬件要求极高的现状,我们通过轻量化模型微调技术,确保了对主流消费级硬件的完美适配。即使是现有的老旧硬件,只需进行微小的升级,即可通过阮咸AI助手焕发第二次生命,化“陈旧资产”为“生产力”。
3. 从“巨额投入”到“敏捷应用”针对传统大模型产品采购流程冗长、成本高昂的问题,阮咸AI助手提供了极具竞争力的价格方案(入门级软硬结合方案不足5万元),并支持灵活的支付模式,让基层单位能快速进入智能化应用通道。
4. 从“单一任务”到“全能流转”传统服务器型大模型往往侧重特定任务,难以应对琐碎的日常需求。阮咸AI助手采用“模块化+工作流”架构,支持零代码编程实现海量应用场景。通过开放式的工作流分享机制,用户间的智慧汇聚,让工具随场景的丰富而不断进化。
5. 基础语言理解使用场景:精细化校对,深度语义分析,实现错别字纠正、语法优化与文风润色;结构化文书生成,针对讲话稿、公告、声明等特定格式,实现标准化文书的快速构建;会议要点提炼:对长篇会议记录进行逻辑梳理,自动生成核心纪要;私有化知识库(RAG):支持海量历史文本导入,构建专属知识库,实现基于自有数据的精准检索与智能问答;多国语言的长文档翻译。
6. 视觉理解应用场景:目标检索与定位:,从海量视频/图像流中,通过特征匹配快速定位特定目标(如车牌、特定物体)。
二.阮咸AI助手的版本介绍
1. 纯软件版本:主要针对已有算力硬件,销售仅包含阮咸AI助手授权,以及3年免费升级服务,价格4.5万元。
目前阮咸AI助手软件对硬件要求比较低:
CPU:最低四核心以上(建议8核);
内存:最低16G以上(建议32G);
硬盘:最低NVME 512G (建议1Tb)
GPU:最低NVIDIA16G独立显存(建议24Gb )
注:该版本(仅作直销,不走招标)
2. 基础版本:主要针对预算有限且无现有算力,包含阮咸AI助授权、三年免费升级服务,一套本地算力(雷电接口+Oculink接口,同时支持笔记本电脑和台式机电脑),即插即用,价格4.98万元。
注:该版本(仅作直销,不走招标)
另:该硬件现在已支持本地Qwen3.6_35B Q4_k_m模型,速度在45-60tokens/s。

3. 便携式工作站版本:主要是对轻量化移动办公有一定要求的用户,主要包括,轻便式工作站,软件授权,辅助配件(含硬件的升级,如定制摄像头、双人麦克风等),三年的软件升级服务。价格9.8万元
注:该版本(可通过集成商、代理商购买)

4. 轻量式塔机版本:主要是对性能有相对较高要求,且对未来2-3年的AI应用的硬件需求进行冗余,主要包括轻便型高算力塔机,软件授权,辅助配件(含硬件的升级,如定制摄像头、双人麦克风等等),三年的软件升级服务。价格19.8万元
注:该版本(可通过集成商、代理商购买)

三.阮咸AI助手工作流批量处理功能介绍(文章篇幅有限,只能罗列基础功能模块)
1.通过多个组合模块拼接可视化工作流,利用轻量化本地大模型的语言理解和图像理解的能力,来实现对批量文件的处理,用来解决传统大模型无批量文件处理的能力:
文档总结、翻译、图片识别挑选、视频理解、图像OCR识别、语音转文字、摄像头调用、数据库读写等等,诸多应用场景功能:


2. 当然,工作流可以通过模板以及AI 对话描述进行自动生成:

3.对工作流执行历史查询:

4.自定义工作流可以导出至文件,通过导入功能将工作流供其他同事使用。
5. 内置常用本地模型,支持用户自己添加额外的大模型进行调用,只需要将模型文件放入指定文件夹即可使用,简单方便。
6.创建自己的知识库,无需配置,只需要把文档放入指定文件夹,软件重启后会自动进行向量化,建立知识库。
7. 内置python和C++的常用编程库和编译环境,可利用本地大模型进行自动编程和编译,直接生成可运行的程序,且能够自动进行bug校正,有些特定的小需求,可以让大模型临时生成一个小软件进行处理,最快只需要几分钟。

四.独立模块--账单话单分析模块
1.银行、支付宝、微信流水账单的清洗入库(依赖AI 自动识别表头)
2.往来拓扑展示,包括资金流向,进出总额,交易金额等,支持选择部分关联人,以及可以手动设定关联人为同一人。

3.支持利用AI语义分析能力,对资金流水数据进行自定义的查询和分析:



4.多人之间的通话关联

5.实时位置和轨迹

6.通过AI 进行问答查询和分析


五.独立模块---视频分析
1. 能够将大量视频进行向量入库,然后通过物品关键词进行快速检索

2. 支持将检索的结果再二次利用本地模型再次进行精准识别:

六.独立模块--案情梳理助手模块
1. 能够将现有的审讯记录、证词、聊天记录等数据一次性加载,由本地大模型进行案情梳理,结合法律条款生成案情梳理报告,并指出可能出现的线索遗漏

七.独立模块----谈话录音转文字。
1.支持双方录音文件直接转谈话记录(定制麦克风能够区分双方),也支持利用定制麦克风进行实时的语音转文字,并且支持加入摄像头进行同步录音录像,识别结果能够二次调用本地大模型进行整理,如去除错别字、合并断句、报告生成等。

八、独立模块--工具中心
1. 集成openclow、hermes、claudecode、opencode、Zread、CodeX等多种智能体接入入口,可用来辅助编程等需求。需要单独下载独立压缩包,离线解压后即可使用用,无需配置。

九.独立模块--人脸修复
1.能够利用轻量化本地AI对模糊的人脸进行清晰化::



十.独立模块---指纹加强模块
1. 对模糊指纹图像进行清晰化处理

2. 对指纹图像进行特征点的比对:

十一.独立功能模块---测谎模块
1. 借助本地轻量模型,利用单摄像头进行测谎辅助,通过本地模型调用摄像头,实时监测面部微表情变化;眼球视线变化;心率变化等关键信息,实时判断谎话概率。

十二.对GPU的实时监测

十三、语音合成模块
1.通过一段语音样本,加上一段文字内容,通过本地轻量化模型合成一段和样本相同音色、讲着指定文字内容的语音文件,主要用于声纹鉴定实验。

(截至2026年7月2日)未完待续
关注阮咸科技
夜雨聆风