
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
【摘要】本文介绍如何通过Herdsman本地推理引擎和TokenRouter工具,实现在ChatGPT(原Codex)中调用本地大模型,减少云端Token消耗并确保数据本地化运行。教程分六步:1)下载Herdsman并安装适合硬件配置的本地模型;2)安装TokenRouter调度引擎;3)选择智能/端侧/云端三种路由策略;4)可视化连接本地模型;5)一键配置ChatGPT;6)选择TokenRou

【摘要】本文介绍如何通过Herdsman本地推理引擎和TokenRouter工具,实现在ChatGPT(原Codex)中调用本地大模型,减少云端Token消耗并确保数据本地化运行。教程分六步:1)下载Herdsman并安装适合硬件配置的本地模型;2)安装TokenRouter调度引擎;3)选择智能/端侧/云端三种路由策略;4)可视化连接本地模型;5)一键配置ChatGPT;6)选择TokenRou

【摘要】本文介绍如何通过Herdsman本地推理引擎和TokenRouter工具,实现在ChatGPT(原Codex)中调用本地大模型,减少云端Token消耗并确保数据本地化运行。教程分六步:1)下载Herdsman并安装适合硬件配置的本地模型;2)安装TokenRouter调度引擎;3)选择智能/端侧/云端三种路由策略;4)可视化连接本地模型;5)一键配置ChatGPT;6)选择TokenRou

【摘要】本文介绍如何通过Herdsman本地推理引擎和TokenRouter工具,实现在ChatGPT(原Codex)中调用本地大模型,减少云端Token消耗并确保数据本地化运行。教程分六步:1)下载Herdsman并安装适合硬件配置的本地模型;2)安装TokenRouter调度引擎;3)选择智能/端侧/云端三种路由策略;4)可视化连接本地模型;5)一键配置ChatGPT;6)选择TokenRou

离线可用安全可控不上传任何文件到云端能直接读懂你本地资料并且普通用户也能快速上手的本地私有化知识库方案——FlowyAIPC 可能是目前最简单、最快速的选择之一。私有模型 + 私有知识库,是未来每个人都能拥有的“数字助理系统”。

Google推出的Gemma4是一款轻量级大语言模型,支持本地私有化部署,在性能和资源占用间取得平衡。通过牧马人本地推理引擎(HerdsmanAI)可轻松部署,提供可视化操作界面和TurboQuant技术优化,使低配置设备也能运行。部署仅需三步:下载模型、一键启动、切换对话。此外,Gemma4还能在FlowyAIPC中实现自动化任务处理,如数据获取、文件操作等,且不消耗Token。FlowyAIP

2026年AI助手市场竞争激烈,Openclaw、HermesAgent等工具成为焦点。国内用户面临海外工具使用门槛高、成本昂贵等问题,而FlowyAIPC提供了更本土化的解决方案。这款工具将电脑变为"AI员工",支持视频生成、知识库管理、定时任务等多样化功能,尤其突出其端云结合设计——简单任务用本地模型,复杂任务调用云端资源,兼顾效率与隐私。其内置的Agent商店覆盖电商、办

2026年AI助手市场竞争激烈,Openclaw、HermesAgent等工具成为焦点。国内用户面临海外工具使用门槛高、成本昂贵等问题,而FlowyAIPC提供了更本土化的解决方案。这款工具将电脑变为"AI员工",支持视频生成、知识库管理、定时任务等多样化功能,尤其突出其端云结合设计——简单任务用本地模型,复杂任务调用云端资源,兼顾效率与隐私。其内置的Agent商店覆盖电商、办

2026年AI助手市场竞争激烈,Openclaw、HermesAgent等工具成为焦点。国内用户面临海外工具使用门槛高、成本昂贵等问题,而FlowyAIPC提供了更本土化的解决方案。这款工具将电脑变为"AI员工",支持视频生成、知识库管理、定时任务等多样化功能,尤其突出其端云结合设计——简单任务用本地模型,复杂任务调用云端资源,兼顾效率与隐私。其内置的Agent商店覆盖电商、办

《大模型命名指南:从参数到量化一网打尽》 摘要:本文系统解析了大语言模型命名规则,帮助用户快速理解模型特性。模型名称通常包含四大要素:1)家族名(如Qwen/Gemma);2)参数量(7B=70亿参数);3)技术标记(MTP=多token预测,MoE=混合专家);4)量化信息(Q4_K_M=4bit量化)。特别提醒:MoE模型需区分总参数和活跃参数(如35B-A3B表示总参350亿/活跃30亿)。








