logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

Ollama 跑大模型太慢?保姆级提速手册!看完速度直接翻 3 倍

发了一句 “你好”,去泡了杯茶、洗了个苹果,回来一看屏幕还在转圈圈显示好不容易等到首字出来,结果一个字一个字蹦,比老太太打字还慢聊个三五轮之后,速度直接断崖式下跌,发个问题要等半分钟才有反应明明买了个不错的显卡,结果跑个 7B 模型都卡成 PPT别慌!这不是你的问题,也不是 Ollama 本身垃圾,99% 的情况都是你没开对设置。这篇手册我会把所有能提速的方法,从 “零成本立竿见影” 到 “进阶配

文章图片
#chrome#前端
博客:从零手写 AI 本地 Skill 工具集|让 AI 听懂自然语言、调用 Python 操控本机文件系统

Skill 机制是本地 AI 脱离 “纯聊天”、落地实用生产力的核心方案。SKILL.md 是 AI 的 “规章制度”,Python 脚本是真实干活的工具,二者结合,就能让 AI 听懂人话、安全操控本机资源。本文这套文件系统 Skill 模板可以直接复用,修改功能就能快速搭建各类私有化 AI 工具集。

文章图片
#人工智能#大数据#算法
七、结果校验与反思模块(Agent Self-Review):AI 内置自我纠错机制

结果校验与反思模块是整套办公 Agent 的 “安全刹车与质检工序”。前面的意图识别、任务规划、工具调用、系统对接负责 “做事”,本模块负责 “查对错、纠错误、控风险”。在企业正式办公场景下,一旦失去自省校验机制,AI 的幻觉、接口异常、参数错误都会直接作用于真实业务文件与业务系统,带来不可预估的办公损失。搭配刚性规则代码校验 + LLM 语义复核的双层方案,既能保障自动化办公效率,又牢牢锁住数据

文章图片
#人工智能
一行命令搞定Python“全家桶”?pip install -e “.[all]“ 大白话全解析!

关键词大白话解释记忆口诀清华镜像国内的高速下载通道不走远路走捷径-e (可编辑)修改代码立即生效,不用重装原地修改,立竿见影.[all]安装所有功能模块和依赖我全都要,一步到位安装软件的动作管家干活这行命令说明你正在进入Python开发的深水区。你不再只是简单的“使用者”,而是开始尝试“掌控”代码。不管这个库是用来做AI、做网站还是做数据分析,掌握了-e模式,你就掌握了开发的主动权!加油,未来的P

文章图片
#python#pip#开发语言
一文吃透大模型 Agent 全部推理范式:从看不懂 ReAct 到全体系落地(技术完整博客)

前面我们梳理了 LangChain、AutoGen、CrewAI 等 Agent 工程框架,很多人初次接触完全搞不懂 ReAct 到底是什么、为什么要推理加行动;再加上市面上还有 CoT、ToT、Reflexion 等一大堆思考模式,本篇从头拆解前因、通俗讲透 ReAct 内核,完整盘点所有主流推理范式,统一沿用之前大厨下厨比喻,零基础也能看懂,附带优缺点、场景、代码、技术链路归档。

文章图片
#react.js#前端#javascript
开发笔记:VSCode + Qt + clangd 明明能正常运行却满屏红波浪线

最近在用 VSCode 搭配 MinGW 开发 Qt 项目,遇到一个特别典型的问题:代码编译、运行完全正常,功能一点问题都没有,但编辑器里全是红色报错波浪线,提示找不到头文件、未定义标识符、不识别编译参数等。折腾一番后彻底搞懂了原因,这里做一篇完整记录,方便以后复用。VSCode 报红 ≠ 代码错误,多半是 clangd 没配置对环境MinGW 编译 vs clangd 默认 MSVC 目标.cl

文章图片
#vscode#qt
VSCode + MinGW + vcpkg 装 OpenCV 踩坑记:为啥最后还是装了 VS2022?

哪怕你全程用 MinGW 写代码、编译项目,只要用 vcpkg 装复杂的库(比如 OpenCV、Boost、Qt),大概率还是需要 MSVC 来编译依赖—— 这不是你的问题,是 vcpkg 生态的现状。很多人一开始和我一样,觉得「我都用 MinGW 了,再装 VS2022 不是多此一举吗?VS2022 Build Tools 只是后台工具,你不用打开它,甚至不用知道它在哪。你写代码还是用 VS C

文章图片
#webpack#前端#node.js
Python 3.14 装不上 PaddleOCR?我用 ONNX Runtime C++ 做了一个免 Python、免安装、直接跑的 PP-OCRv4 工具

识别图片中的中英文、数字混合文字内容提取图片角落的水印、时间、编号类附加信息最终输出结构化 JSON,可直接对接业务系统使用但我遇到一个致命大坑:我的 Python 是 3.14.4,版本太新,PaddlePaddle 官方还未完成适配,pip 直接报错找不到匹配的安装包。不想降级 Python、不想折腾虚拟环境、不想用识别效果拉胯的 Tesseract、不想装一堆复杂依赖?那这篇文章就是你的终极

文章图片
#python#c++
本地大模型推理引擎全维度实测对比(vLLM vs Ollama vs llama.cpp vs LM Studio vs TensorRT-LLM)

哪个最快?哪个省显存?哪个支持多模态 / 工具调用?新手选哪个?生产环境用哪个?本文用统一硬件(RTX 4090 24GB / M4 16GB / 低配笔记本)、统一模型(Llama 3 70B / Qwen2.5 7B / Llama 4 Scout),从10 大核心维度实测对比,含多模态、Function Call、吞吐量、显存、延迟、并发、易用性、稳定性、生态、适用场景,结论直接可用。维度v

文章图片
#java#开发语言
2026 年 5 月|10B 以下小模型终极排名:Qwen3.6 登顶 + 全模型能力清单

3B 激活消耗,普通电脑流畅跑性能对标 27B 稠密模型256K 上下文,读长文档无压力Apache 2.0 开源,个人 / 公司随便用Agent / 编程极强,适合本地开发、自动化2026 年小模型进入MoE 时代小参数 = 大能力本地跑 = 更安全、更快、更便宜Qwen3.6-35B-A3B = 10B 以下新王。

文章图片
#人工智能
    共 395 条
  • 1
  • 2
  • 3
  • 40
  • 请选择