logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

别再只调学习率了!Qwen2.5微调实战:用LLaMA-Factory详解LoRA、SFT等关键参数怎么配

本文深入解析Qwen2.5微调实战,通过LLaMA-Factory工具详解LoRA、SFT等关键参数的配置技巧。从微调技术选型到训练参数优化,再到数据工程和评估迭代,提供全面的技术进阶指南,帮助开发者从参数盲调到精准配置,提升大模型微调效果。

#LLaMA-Factory
从CodeBuddy到办公龙虾:WorkBuddy如何用AI智能体重塑办公流程

在人工智能技术普及的今天,大语言模型和智能体(Agent)已成为提升生产力的关键技术。其核心原理在于通过理解、规划和执行复杂任务序列,将AI从单纯的内容生成工具转变为工作流程的主动参与者。这一技术价值在于能够深度集成企业现有工具链,实现跨应用、跨数据的自动化操作,从而显著降低任务切换与协调的认知负荷。在办公自动化这一典型应用场景中,AI智能体需要克服非结构化数据理解、上下文长期记忆以及安全权限管控

大模型本地部署实战:Kimi K3与Qwen3.8 Max的成本与工程化选型指南

大语言模型(LLM)的部署与推理优化是AI工程化落地的核心环节,其本质是在有限的计算资源下,通过模型量化、推理加速等技术,平衡性能、速度与成本。从技术原理看,量化(如INT4/INT8)通过降低模型权重精度来减少显存占用,而推理框架(如vLLM、llama.cpp)则通过注意力优化和内存管理来提升吞吐量。这些技术的价值在于,它们直接决定了模型能否从实验室走向生产环境,尤其是在消费级硬件上实现高效运

阿里云AI Agent可观测方案:透视Multi-Agent系统,破解黑箱调试难题

在AI Agent,特别是Multi-Agent系统的开发与运维中,传统的监控和日志方案往往面临失效的困境。这源于AI Agent基于大语言模型(LLM)驱动的非确定性推理特性,其执行路径难以预测,上下文复杂且动态,工具调用依赖外部服务,使得整个系统如同一个“黑箱”。为了应对这一挑战,可观测性(Observability)技术应运而生,它通过全链路追踪、深度度量、会话回放等核心能力,为分布式、非确

【图像增强实战】从频域滤波到深度学习:一站式解决条纹、暗角、模糊与噪声

本文全面解析图像增强技术,涵盖频域滤波、暗角校正、去模糊和噪声消除四大核心问题。通过FFT消除条纹、U-Net校正暗角、RL反卷积去模糊以及DnCNN降噪等实战案例,提供从传统算法到深度学习的完整解决方案,帮助开发者高效处理工业检测、医学影像等场景中的图像质量问题。

从玩具数据集到实战:用make_circles和make_moons解锁Python机器学习可视化

本文详细介绍了如何使用Python中的make_circles和make_moons函数生成玩具数据集,并应用于机器学习可视化实践。通过参数调优、数据探索和模型训练,帮助初学者理解非线性可分数据集的特点,并掌握数据可视化和分类算法的核心技巧。

#机器学习#数据可视化
PyTorch新手避坑指南:从零开始玩转张量(Tensor)的21个核心操作

本文为PyTorch新手提供21个核心张量操作避坑指南,涵盖张量创建、形状操作、运算陷阱及与NumPy的转换技巧。重点解析了`reshape`与`view`的区别、广播机制的风险、原地操作的隐患以及类型提升规则,帮助开发者高效使用PyTorch进行深度学习开发。

#深度学习
告别Anchor Boxes:手把手带你用PyTorch复现FCOS目标检测模型(附完整代码)

本文详细介绍了如何使用PyTorch复现FCOS(Fully Convolutional One-Stage)目标检测模型,这是一种无需Anchor Boxes的先进方法。通过逐步解析模型架构、特征金字塔网络(FPN)实现、正负样本分配策略及Centerness机制,帮助读者理解并实践这一前沿技术。附完整代码,适合开发者快速上手并应用于实际项目。

#目标检测#深度学习
用PyTorch手把手复现Xception模型:从深度可分离卷积到完整网络搭建(附代码)

本文详细介绍了如何使用PyTorch从零开始复现Xception模型,重点解析了深度可分离卷积的实现原理及其在Xception架构中的应用。通过逐步构建Entry Flow、Middle Flow和Exit Flow模块,并附有完整代码示例,帮助开发者深入理解这一高效CNN模型的设计精髓与实现细节。

#深度学习#计算机视觉
PyTorch训练时内存爆了?试试用torch.no_grad()给你的模型推理瘦身

本文深入探讨了PyTorch模型推理阶段使用torch.no_grad()优化内存和性能的关键技术。通过禁用梯度计算,可显著降低内存占用达30%并提升推理速度,特别适合Web服务和边缘设备部署。文章详细解析了其底层机制、最佳实践及常见陷阱,并提供了与其他优化技术结合的完整方案。

#深度学习
    共 50 条
  • 1
  • 2
  • 3
  • 4
  • 5
  • 请选择