logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

Ollama极简部署手册:5步搞定本地AI模型高效运行

本文提供Ollama本地AI模型部署的极简指南,5步实现高效运行。详细介绍了从系统环境检查、一键安装到模型下载与基础使用的完整流程,帮助用户快速掌握AI模型部署技巧,特别适合需要离线使用AI的场景。

#Ollama
Qwen3 大模型进阶:基于 vLLM 与 Function Call 构建企业级智能体(Agent)应用

本文详细介绍了如何基于Qwen3大模型和vLLM推理框架构建企业级智能体应用。通过技术选型、环境部署、函数调用实践和性能优化等环节的深入解析,帮助开发者高效实现AI智能体的企业级落地,显著提升业务处理效率与系统稳定性。

#vLLM
保姆级教程:用SWIFT 2.6.0微调Qwen2-VL-7B多模态模型,从SFT到RLHF完整避坑

本文提供了一份详细的SWIFT 2.6.0微调Qwen2-VL-7B多模态模型的保姆级教程,涵盖从SFT到RLHF的全流程避坑指南。重点介绍了环境配置、数据准备、SFT微调、RLHF优化和模型部署等关键步骤,特别针对MAX_PIXELS设置、transformer版本冲突等常见问题提供解决方案,帮助开发者在单卡GPU环境下高效完成多模态模型微调。

#多模态
SpringBoot与Ollama深度整合:从本地部署到Web应用实战

本文详细介绍了如何将本地部署的Ollama大语言模型与SpringBoot框架进行深度整合,构建可对外提供服务的Web应用。内容涵盖从环境准备、项目搭建、核心配置与模型连接测试,到构建支持流式输出的Web API控制器,并解决了中文乱码等常见问题。最后探讨了会话记忆、异常处理等生产级应用的进阶考量,为开发者提供了一套完整的实战指南。

#Ollama
Llama 3多模态实战:手把手教你集成图像与语音能力到你的应用

本文详细介绍了如何将Llama 3的多模态能力集成到应用中,包括图像与语音功能的实战开发。通过模块化设计、GQA机制和RoPE技术,Llama 3在视觉问答、语音交互等场景中展现出高效性能。文章提供了从环境搭建到生产部署的完整指南,帮助开发者快速实现多模态智能应用。

不只是部署:聊聊中科院这个ChatGPT学术优化项目能帮你做什么(附API Key省钱技巧)

本文深入解析中科院ChatGPT学术优化项目在科研场景中的实际应用,涵盖论文写作辅助、代码分析与文献速读等核心功能。特别提供API Key成本控制技巧,包括请求优化和用量监控策略,帮助研究者高效利用这一智能工具提升学术工作效率。

#ChatGPT
从“人工智障”到“智能伙伴”:我用这5个技巧,彻底驯服了Claude和ChatGPT

本文分享了5个高效使用Claude和ChatGPT的技巧,帮助用户从基础提示词设计到思维链拆解,再到创造性约束和动态模板策略,最终实现AI与人类思维的深度协作。通过精准的提示词和分步思考法,显著提升AI生成内容的质量和实用性,适用于文案创作、市场分析等多种场景。

#AI
从零部署到API封装:基于Ollama与CPU的GGUF量化模型实战指南

本文详细介绍了如何在CPU环境下使用Ollama部署GGUF量化模型,并封装为RESTful API的完整流程。从环境准备、模型配置到性能优化和API服务化部署,提供了基于WizardCoder-Python-13B-V1.0模型的具体实践指南,帮助开发者快速实现本地AI模型的部署与应用。

#Ollama
Claude Code Skills配置避坑指南:为什么你的技能不触发?从文件路径到触发词的全解析

本文详细解析了Claude Code技能配置中的常见问题,从文件路径、编码格式到触发词设计的全流程解决方案。特别针对Skills配置不触发的痛点,提供了目录结构验证、触发词优化和Markdown格式规范等实用技巧,帮助开发者高效避坑。

#开发者工具
机器学习特征工程:数值型特征选择性缩放实战指南

特征工程是机器学习预处理的核心环节,其中数值型特征缩放直接影响模型性能。标准化(Z-score)和归一化(MinMax)是两种基础缩放方法,前者通过(x-μ)/σ消除量纲影响,后者将数据压缩到固定区间。在电商推荐和金融风控等场景中,选择性缩放能提升模型AUC指标11.6%。实际工程中需注意:对连续变量和计数型变量优先缩放,而GPS坐标等物理特征应保持原样。结合RobustScaler对异常值的鲁棒

    共 72 条
  • 1
  • 2
  • 3
  • 8
  • 请选择