logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

机器学习与深度学习算法架构全景解析XMind思维导图原文件

机器学习是让计算机系统通过数据自动改进性能的学科,其核心在于从经验中学习规律并泛化至未知样本。它依赖于模型、损失函数与优化算法三大组件,构建“输入→预测→误差反馈→参数调整”的闭环流程。PyTorch 的模块化设计鼓励用户通过组合基础组件构建复杂模型。nn.Module是所有神经网络模块的基类,支持嵌套、参数注册和状态保存。以下是一个带有注意力机制的 LSTM 文本分类模型示例:# 计算注意力权重

Docker容器化部署实时口罩检测模型:生产环境最佳实践

本文介绍了如何在星图GPU平台上自动化部署实时口罩检测-通用镜像,实现高效AI模型容器化部署。该镜像能够快速构建口罩检测应用,适用于公共场所实时视频流分析,提升公共卫生安全监控效率。通过Docker容器化技术,确保模型在不同环境中的稳定运行和便捷部署。

DS3231高精度时钟保障起床闹钟智能推荐准确

DS3231是一款高精度实时时钟芯片,具备温度补偿功能,精度达±2ppm,年误差不足1分钟。它在智能起床闹钟中作为时间锚点,支持精准唤醒、低功耗运行和断电走时,显著提升用户体验。

基于JS+CSS3实现的交互式电子数字时钟项目

简介:“JS+CSS3电子数字时钟代码”是一个前端实践项目,利用JavaScript和CSS3技术构建了一个具备实时时间显示与秒表进度条功能的动态数字时钟。该时钟可自动获取用户本地时间,并通过定时器实现实时更新;结合事件监听机制,支持点击按钮控制秒表的开始与暂停,增强交互体验。项目综合运用了DOM操作、时间处理、CSS动画及响应式布局等核心技术,适合用于学习前端基础技能的整合应用。

Cleer ARC5耳机边缘计算节点状态语音反馈系统设计

Cleer ARC5通过边缘计算与本地语音合成,实现耳机对自身运行状态的实时语音反馈。系统涵盖状态监测、语义映射、上下文感知与离线TTS,兼顾低功耗、隐私保护与用户体验,推动智能穿戴从工具迈向可交互伙伴。

#边缘计算
KubeCon云原生顶级会议

KubeCon作为CNCF主办的全球性技术大会,汇聚了云原生领域的最新进展与工程实践。它不仅是技术发布的平台,更是社区协作、项目孵化和工程文化演进的核心场所。通过真实案例、失败复盘与前沿探索,KubeCon推动了Kubernetes、服务网格、可观测性等技术的规模化落地。

#云原生
PyTorch-CUDA镜像部署 Baichuan2 大模型技术要点

本文介绍如何利用PyTorch-CUDA Docker镜像高效部署Baichuan2-13B大模型,解决环境不一致、显存不足与多卡通信等问题。通过容器化方案实现CUDA、PyTorch、NCCL等组件的版本对齐与性能优化,支持BF16推理、device_map自动分片及分布式训练,提升大模型开发与部署效率。

基于vLLM的大模型API服务搭建全流程教学

本文详细介绍如何使用vLLM构建高性能大模型API服务,涵盖PagedAttention与连续批处理核心技术,提供从本地推理到OpenAI兼容API部署的全流程实战代码,并给出生产级架构设计、弹性伸缩、监控安全等关键建议,显著提升推理吞吐与显存利用率。

#vLLM
极小体积+核心功能Miniconda成为Docker镜像首选

Miniconda凭借极小体积与强大依赖管理能力,成为Docker镜像构建的首选。它支持精准的环境复现、跨平台一致性及非Python依赖管理,显著提升AI项目在CI/CD中的效率与稳定性,兼顾轻量化与工程化需求。

GPT-OSS-20B量化版本发布,8GB内存也能跑大模型

GPT-OSS-20B推出INT4量化版本,仅需不到8GB内存即可流畅运行,结合稀疏激活与MoE架构,实现消费级硬件上的高性能推理。支持GGUF等格式,兼容主流推理引擎,适用于本地部署的医疗、法律、教育等专业场景,推动AI民主化落地。

    共 956 条
  • 1
  • 2
  • 3
  • 96
  • 请选择