logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

Qwen3.8开源:2.4T谁部署得起

Qwen3.8-Max 发布两周了。这两周里,2.4T 权重和 27B 稠密版先后开源,DeepSeek 的涨价方案也刚好在今天生效。热搜退了,账该补上了。这次上秤的是史上最重的权重,尺子还是第一篇那把,每成功任务成本。 回看发布日:2.4 万亿参数,API 输入 12 元...标签:Qwen、大模型部署、开源大模型、MoE、推理成本

文章图片
#开源#云计算#人工智能
读懂 A100:廉颇老矣,尚能饭否

摘要:A100的两段生命周期与技术亮点 NVIDIA A100是2020年发布的Ampere架构旗舰GPU,曾是大模型训练的主力算力(如ChatGPT、LLaMA)。其核心创新包括: TF32精度:兼容FP32代码,自动启用张量核心加速训练; MIG多实例:单卡硬件级切分为7个隔离实例,提升多租户利用率; 80GB HBM2e显存(2.0 TB/s带宽)与第三代张量核心。 A100经历了两阶段应用

文章图片
#人工智能
读懂 A100:廉颇老矣,尚能饭否

摘要:A100的两段生命周期与技术亮点 NVIDIA A100是2020年发布的Ampere架构旗舰GPU,曾是大模型训练的主力算力(如ChatGPT、LLaMA)。其核心创新包括: TF32精度:兼容FP32代码,自动启用张量核心加速训练; MIG多实例:单卡硬件级切分为7个隔离实例,提升多租户利用率; 80GB HBM2e显存(2.0 TB/s带宽)与第三代张量核心。 A100经历了两阶段应用

文章图片
#人工智能
到底了