logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

MindSpore大模型转换实战:权重映射、计算图对齐与鸿蒙端侧部署

深度学习模型部署中,跨框架迁移是常见需求。模型转换涉及权重映射与计算图对齐两个核心层面,前者解决参数命名与形状匹配,后者确保算子语义等价。由于框架间默认参数、动态控制流等差异,转换工具通常提供映射基础设施而非全自动方案,需人工介入验证。在鸿蒙端侧部署场景中,模型需导出为MindIR格式,并关注量化压缩与线程管理。本文围绕MindSpore大模型转换工具链,详解从PyTorch/TensorFlow

oracle grid复制死机,Oracle11g grid安装遇到奇怪问题

安装进行到65%停着不动,正在copying 文件到另一个节点, scp copy没有问题。nstantiating '/u01/app/11.2.0/grid/rdbms/install/config_filemap.sbs'.instantiating '/u01/app/11.2.0/grid/demo/schema/mk_dir.sql.sbs'.Setting up 'Oracle ..

linux清空某个文件io缓存,Linux 文件IO 和 标准IO

[TOC]Linux 文件IO 和 标准IOLinux 文件IOLinux中做文件IO最常用到的5个函数是: open ,close ,read ,write 和 lseek ,不是ISO C的组成部分,这5个函数是不带缓冲的IO,也即每个read和write都调用了内核的一个系统调用。#include #include int open(const char *pathname, i...

别再让通用Embedding模型拖后腿了!手把手教你用LoRA微调Qwen3-0.6B,提升RAG召回率

本文详细介绍了如何利用LoRA技术对Qwen3-0.6B模型进行高效微调,以提升专业场景下的RAG召回率。通过精准的领域适配和优化的训练流程,显著改善医疗、法律等专业领域的语义理解能力,解决通用Embedding模型在专业术语和逻辑关联上的不足。

#LoRA#RAG
保姆级教程:在Jetson Orin上跑通YOLOv8+DeepOCSort多目标跟踪(附模型下载与常见报错解决)

本文提供在Jetson Orin上部署YOLOv8+DeepOCSort多目标跟踪系统的保姆级教程,涵盖环境配置、模型下载、性能优化及常见报错解决方案。特别针对边缘计算场景,详细介绍了ARM架构下的PyTorch部署、TensorRT加速以及多流处理架构设计,帮助开发者高效实现实时目标跟踪应用。

#边缘计算
从双十一大屏到交通监控:大数据可视化大屏的行业应用全解析

本文全面解析了大数据可视化大屏在电商、智慧交通、气象预警等10个行业的实战应用案例。从双十一交易大屏到智慧城市治理,展示了如何将海量数据转化为直观图形,提升决策效率。重点介绍了关键技术方案和行业特殊需求,为开发者提供实用参考。

#大数据#智慧城市
从MySQL到Hive:一份保姆级的Flink SQL实时数仓搭建与调优指南(附避坑点)

本文详细介绍了如何使用Flink SQL构建从MySQL到Hive的实时数据仓库,涵盖环境配置、CDC数据采集、流式ETL处理、Hive数据落地等全流程,并提供生产环境中的调优技巧与常见问题解决方案。通过Flink的强大流处理能力,实现高效、稳定的实时数据处理与分析。

#数据仓库#大数据
面试官到底想问什么?拆解机器学习中的线性代数高频考点(PCA、最小二乘)

本文深入解析机器学习面试中线性代数的高频考点,重点探讨PCA和最小二乘的核心原理与应用。从协方差矩阵特征分解到奇异值分解(SVD)的实战价值,再到最小二乘中的矩阵秩与正则化问题,帮助候选人理解面试官的真实考察意图。通过代码示例和面试对话还原,揭示如何将抽象的数学概念转化为有业务洞察力的回答,提升机器学习岗位的面试通过率。

#机器学习#线性代数
大模型选型指南:从基准测试到场景适配的工程实践

在人工智能领域,模型评估与选型是构建智能应用的基础环节。传统上,业界依赖MMLU、GSM8K等学术基准测试作为模型能力的“标尺”,通过量化分数进行横向比较。然而,这种单一维度的评价体系在实际工程落地中逐渐暴露出局限性,因为它难以全面反映模型在真实场景下的综合表现,特别是忽略了延迟、成本、稳定性等关键工程指标。随着大模型能力光谱的不断分化,技术价值正从追求通用“最强”转向实现特定场景下的“最优”。开

2026 GTC开发者指南:CUDA-X微服务、NIM与Omniverse Cloud API重塑AI与机器人开发

在人工智能与高性能计算领域,微服务架构和容器化部署正成为提升开发效率与系统可维护性的关键技术。其核心原理在于将大型单体应用拆分为独立、松耦合的服务,通过API进行通信,从而实现快速迭代、弹性伸缩和简化运维。这一模式的技术价值在于能够大幅降低AI模型部署、复杂工作流编排以及混合云环境管理的复杂度。具体到应用场景,它使得从模型训练、推理优化到数字孪生构建的全链路得以标准化和自动化。本文将结合CUDA-

    共 67 条
  • 1
  • 2
  • 3
  • 7
  • 请选择