logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

避坑指南:MindFormers框架下tokenizers库版本兼容性那些事儿(附ChatGLM2实战案例)

本文深入解析了MindFormers框架下tokenizers库版本兼容性问题,特别是ChatGLM2模型中出现的`AttributeError: 'tokenizers.AddedToken' object has no attribute 'special'`错误。通过实战案例,提供了依赖管理、虚拟环境构建、版本冲突诊断与解决的系统化方法,帮助开发者有效规避类似问题,提升AI项目稳定性。

别再只用ChatGPT了!用LangChain+DeepSeek搭建你的第一个AI对话机器人(Python保姆级教程)

本文详细介绍了如何使用LangChain框架和DeepSeek大模型搭建AI对话机器人,提供Python保姆级教程。通过对比ChatGPT的高昂API费用,展示了LangChain+DeepSeek组合在成本效益、对话记忆管理和工具链集成方面的优势,帮助开发者快速构建多轮对话智能助手。

#DeepSeek
机器学习工程师在媒体行业的实战经验与MLOps架构解析

机器学习(ML)作为人工智能的核心技术,正在深刻改变各行各业的工作方式。其基本原理是通过算法从数据中学习规律,并应用于预测或决策任务。在工程实践中,MLOps(机器学习运维)成为确保模型从开发到部署全生命周期高效运行的关键框架,它结合了DevOps理念与机器学习特性,实现模型的持续集成与交付。对于媒体行业而言,ML技术尤其重要,它能优化内容推荐、广告投放等核心业务场景。以DPG Media为例,其

从YOLO预测到TIDE洞察:一站式模型性能评估实战

本文详细介绍了从YOLO预测到TIDE洞察的一站式模型性能评估实战流程。通过YOLO模型验证输出转换为COCO格式,利用TIDE工具进行深度性能分析,揭示模型在分类错误、定位误差等方面的具体问题,并提供优化方案。文章结合实战案例,展示如何通过TIDE诊断提升模型性能,特别关注小物体检测和复杂场景下的表现改进。

机器学习中的三种均值:算术、几何与调和详解

均值计算是机器学习与数据分析中的基础操作,主要包括算术均值、几何均值和调和均值三种类型。算术均值适用于同单位数据的集中趋势度量,但对异常值敏感;几何均值擅长处理不同量纲的乘积关系,如增长率计算;调和均值则是比率型数据(如速度、F1 Score)的理想选择。正确选择均值类型能显著提升模型评估的准确性,比如在金融风控中综合多维度指标,或在计算机视觉中计算特征密度。理解这些均值的数学特性及适用场景,是避

#机器学习
用Anaconda虚拟环境为DensePose搭建独立Python 3.6环境:告别系统环境污染与版本冲突

本文详细介绍了如何通过Anaconda虚拟环境为DensePose搭建独立的Python 3.6环境,解决依赖冲突和系统环境污染问题。从Anaconda配置、核心依赖安装到GCC编译器降级,提供了完整的安装教程,确保DensePose在隔离环境中顺利运行。

深度学习能力展示:高效面试与项目答辩方法论

深度学习作为人工智能的核心技术,其能力展示在技术面试和项目竞标中至关重要。理解反向传播、模型架构等基础原理是构建深度学习系统的基石。通过可视化数学推导过程(如梯度计算)和模型解剖(如ResNet层级分析),可以直观展现技术深度。规范的工程实现(如Dataset类设计)和可复现的环境配置(requirements.txt)则体现工程能力。这些方法不仅提升评估效率,在AI工程师招聘中验证通过率提升2.

#深度学习
大模型微调实战:基于InternLM/xtuner的QLoRA高效调优指南

大语言模型微调是使通用模型适应特定领域任务的关键技术,其核心原理是通过在预训练模型基础上,利用领域数据进行参数更新,从而在保留通用知识的同时获得专业能力。以LoRA、QLoRA为代表的高效微调技术,通过引入少量可训练参数,在显著降低计算和显存开销的前提下实现性能逼近全参数微调,具有极高的技术价值。这些方法广泛应用于构建垂直领域的智能客服、代码助手、知识问答等场景。本文聚焦于上海人工智能实验室开源的

深度学习模型评估:从基础指标到生产环境实践

模型评估是机器学习工作流中的关键环节,涉及从基础统计指标到工程落地的完整技术链。在分类任务中,准确率、混淆矩阵和F1 Score构成了基础评估三角,而回归任务则依赖MSE、MAE等误差指标。这些指标通过PyTorch和sklearn等框架实现,为模型优化提供量化依据。随着模型进入生产环境,评估维度需要扩展到推理延迟、内存占用等工程指标,此时TensorRT加速和模型量化成为关键技术手段。特别是在计

ModelTables:机器学习模型表格检索与应用实践

表格数据在机器学习领域是组织模型性能指标、参数配置的核心载体。随着Hugging Face等开源模型库的普及,如何高效检索海量模型表格成为关键技术挑战。ModelTables通过构建专业语料库,结合结构去重和语义检索技术,解决了模型比较中的数据碎片化问题。其创新点在于:1) 针对模型卡片、GitHub仓库和学术论文设计三级过滤流程;2) 采用基于Sentence-BERT的混合检索方法,在GLUE

    共 132 条
  • 1
  • 2
  • 3
  • 14
  • 请选择