logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

一张消费级4090跑DeepSeek-R1-Distill-Qwen-7B?这份极限“抠门”的量化与显存优化指南请收好...

一张消费级4090跑DeepSeek-R1-Distill-Qwen-7B?这份极限“抠门”的量化与显存优化指南请收好【免费下载链接】DeepSeek-R1-Distill-Qwen-7B探索深度学习新境界,DeepSeek-R1-Distill-Qwen-7B模型以卓越推理能力引领潮流,显著提升数学、编程和逻辑任务...

【限时免费】 生产力升级:将videocomposer_ms模型封装为可随时调用的API服务

生产力升级:将videocomposer_ms模型封装为可随时调用的API服务【免费下载链接】videocomposer_msMindSpore implementation & optimization of VideoComposer: Compositional Video Synthesis with Mot...

【性能暴涨60%】Qwen2-1.5B-Instruct全链路拆解:从基座架构到工业级部署

你是否正在经历这些痛点:7B大模型部署成本过高?本地推理速度慢到无法忍受?开源模型数学推理能力薄弱?Qwen2-1.5B-Instruct的出现彻底改变了这一局面——这个仅1.5B参数的模型在GSM8K数学基准上实现了61.6%的正确率,较上一代Qwen1.5-1.8B提升74.5%,同时推理速度提升3倍,显存占用降低40%。本文将带你从模型架构、技术实现到工程部署进行全链路拆解,读完你将获得:.

到底了