logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

Qwen3.6正式开源,华为昇腾910B实现高效适配

多模态能力方面,模型原生支持“思考/非思考”双模式切换,在MMBench、RealWorldQA等视觉语言基准测试中表现媲美Claude-Sonnet-4.5,尤其在空间智能领域,RefCOCO基准得分达92.0,ODInW13基准得分50.8,能够精准完成图像目标定位、文档信息提取等复杂任务。该模型采用混合专家(MoE)架构,以350亿总参数量、仅激活30亿参数的轻量化设计,在编程、多模态理解等

文章图片
#开源#华为#AI作画
华为昇腾 1 张卡 300I Duo 跑 Qwen3.6-27B、Qwen3-Embedding-8B 嵌入模型、Qwen3-Reranker-8B 重排序模型(GPUStack 辅助),保姆级命令及

摘要:本教程详细介绍了在华为昇腾Atlas 300I Duo(单卡双NPU)上部署Qwen3系列模型的完整流程。硬件配置为单卡双NPU(96GB显存),部署组合包括Qwen3.6-27B对话模型(TP=2)、Qwen3-Embedding-8B嵌入模型和Qwen3-Reranker-8B重排序模型,形成完整的RAG全链路解决方案。教程涵盖环境配置(驱动、CANN工具包、Docker)、GPUSta

文章图片
#java#python#人工智能
2 张天数智芯 天垓 150(单卡 64GB,计 128GB HBM)可跑最大 Qwen3-8B、Qwen3-14B FP16 LoRA 模型 + 完整实操步骤 、 命令

摘要 本文详细介绍了在2张天数智芯天垓150(单卡64GB HBM,共128GB显存)上微调Qwen3系列大模型的技术方案与实操步骤。核心结论: 硬件适配性 标准DDP模式:Qwen3-8B可稳定训练(batch=8~12),Qwen3-14B需极小batch且易OOM,30B及以上无法运行。 FSDP分片模式:通过权重/梯度/优化器分片,双卡可极限微调Qwen3-14B(需batch=1,序列≤

文章图片
#人工智能#华为#服务器 +3
Cloudera报告显示,约 80% 的企业表示 AI大模型 发展受制于Hadoop大数据访问阻碍

Cloudera最新报告揭示企业AI应用面临"数据鸿沟":96%企业已部署AI,但80%仍受数据访问限制困扰。主要障碍包括数据质量(22%)、成本超支(16%)和系统整合问题(15%)。报告指出84%企业自认数据可靠,但仅18%实现全面治理,暴露出严重的数据治理盲区。行业差异显著:电信业54%清楚数据位置,而金融业仅30%。随着AI进入实施阶段,解决数据基础问题将成为企业成败关

文章图片
#人工智能#大数据#cloudera
【华为昇腾910B】在AI大模型推理速度与GPU显卡选择中地位

在这个规模下,单卡推理4090的性能与A100几乎持平(模型能完整放在一张卡里,不涉及多卡通信),但价格只有A100的十分之一。397B总参数量的旗舰模型,实际激活只有17B参数,显存需求只有34GB。以RTX 4090的24GB显存为例:7B模型(FP16)稳跑,13B模型(FP16)基本能跑但长序列有压力,30B及以上不量化基本跑不了。Qwen3.6-27B是270亿参数的稠密多模态模型,支持

文章图片
#人工智能#华为#大数据
天数智芯天垓150S|华为泰山鲲鹏服务器 LLM大模型部署&微调 保姆级实操教程(CoreX4.4.0)

链接: https://pan.baidu.com/s/1PDj6dySUNHotNABp7d1a0w?链接:https://pan.baidu.com/s/1wbRWJUSyElplFgse_NyOwg?:LLaMA2、Qwen、ChatGLM、Baichuan 7B/13B 推理、LoRA微调。:全卡统一 2.1.4(必须,否则训练抖动、功耗N/A)# 1. 查看显卡识别、固件、功耗是否正常(

文章图片
#服务器#运维#华为 +4
华为昇腾 1 张卡 300I Duo 跑 Qwen3.6-27B、Qwen3-Embedding-8B 嵌入模型、Qwen3-Reranker-8B 重排序模型(GPUStack 辅助),保姆级命令及

摘要:本教程详细介绍了在华为昇腾Atlas 300I Duo(单卡双NPU)上部署Qwen3系列模型的完整流程。硬件配置为单卡双NPU(96GB显存),部署组合包括Qwen3.6-27B对话模型(TP=2)、Qwen3-Embedding-8B嵌入模型和Qwen3-Reranker-8B重排序模型,形成完整的RAG全链路解决方案。教程涵盖环境配置(驱动、CANN工具包、Docker)、GPUSta

文章图片
#java#python#人工智能
华为昇腾 1 张卡 300I Duo 跑 Qwen3.6-27B、Qwen3-Embedding-8B 嵌入模型、Qwen3-Reranker-8B 重排序模型(GPUStack 辅助),保姆级命令及

摘要:本教程详细介绍了在华为昇腾Atlas 300I Duo(单卡双NPU)上部署Qwen3系列模型的完整流程。硬件配置为单卡双NPU(96GB显存),部署组合包括Qwen3.6-27B对话模型(TP=2)、Qwen3-Embedding-8B嵌入模型和Qwen3-Reranker-8B重排序模型,形成完整的RAG全链路解决方案。教程涵盖环境配置(驱动、CANN工具包、Docker)、GPUSta

文章图片
#java#python#人工智能
CDH6.3 运行hive -e “show databases;“报错:hive-env.sh:行24: hbase-common.jar: 权限不够(CDP7.1.7许可证)

opt/cloudera/parcels/CDH-6.3.2-1.cdh6.3.2.p0.1605554/bin/../lib/hive/conf/hive-env.sh:行29: /opt/cloudera/parcels/CDH-6.3.2-1.cdh6.3.2.p0.1605554/lib/hbase/lib/htrace-core.jar: 权限不够。修改相关的*.sh运行脚本,因为SH脚

文章图片
#hive#hbase#jar
华为 GaussDB 商业版(本地部署)部署方案及相关步骤

摘要: 华为GaussDB商业版支持本地私有化部署,面向政企客户需求,提供高可用、国产化合规的数据库解决方案。部署核心包括GaussDB实例、TPOPS管理平台及可选DRS迁移工具,需满足严格硬件(8核/64GB/1TB存储)、国产OS(如麒麟)及UTC时区等要求。TPOPS需三节点高可用部署,通过容器化脚本自动安装,后续通过Web控制台管理实例与License。关键注意版本匹配、存储性能及网络隔

文章图片
#华为#hadoop#hive +3
    共 277 条
  • 1
  • 2
  • 3
  • 28
  • 请选择