logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

PyTorch On Java 体系 视频课程已发布 AI Infra3.0 【硕士研一课程】

基于cpp libtorch 的全量代码编译的java版本,PyTorch On Java 来了,一万个重载的Tensor算子,混合精度,量化,AOT ,gloo nccl 分布式训练,flash attention ,支持 Trition TensorRT,支持Nvidia Cuda,Google TPU,HW NPU 等30多种设备,支持一步加载各种大模型 qwen llama yolo ,一

文章图片
#人工智能#pytorch#java
Java深度学习【Huggingface SafeTensors模型加载推理及大模型微调】【Ai Infra3.0】PyTorch ON Java 实现全栈模型生命周期管理

确切的来说,这是一次实验,也是一次突破,很成功,给了我们很大的信心,未来我们会在这方面投入更多的精力来做。要实现 safetensors 格式的模型加载,要实现最少四个模块,一个是model,一个 config ,一个是loader ,一个是tokenizer ,不过对于多模态和未来的扩展,你还需要实现 processor 和pipeline ,这些基本上都是参考python transforme

#深度学习#人工智能#java
JVM深度学习框架 从夯到拉【Pytorch ON JAVA】来 让大模型给个排位 AI Infra3.0

java生态的有很多深度学习框架,从夯到拉,客观评价一下 javacpp-pytorch STORCH easyaiomega brain4j djl deeplearning4j tensorflow,他们的优缺点和特点,给个排名。java深度学习在Python AI的强势打压下,也是牛鬼蛇神 群魔乱舞春秋,那么能不能做个排名呢,下面我们让 deepseek 豆包 gemini google 给

文章图片
#深度学习#人工智能#pytorch
【Java深度学习】PyTorch On Java 系列课程 第二章 04 :张量高级操作【AI Infra 3.0】[PyTorch Java 硕士研一课程]

本章介绍了PyTorch中的高级张量操作,主要包括索引切片、形状变换和组合分割等核心功能。通过索引和切片可以精确访问和修改张量元素,支持基础索引和多维访问。形状变换操作如view()、reshape()和permute()能够在不改变数据的情况下重构张量结构。此外,cat()、stack()等函数用于组合多个张量,而split()、chunk()则用于分割张量。这些操作配合广播机制和数据类型转换,

文章图片
#深度学习#人工智能#java
【Java深度学习】PyTorch On Java 系列课程 第三章 07 :张量梯度【AI Infra 3.0】[PyTorch Java 硕士研一课程]

摘要:PyTorch中的.grad属性存储了通过backward()方法计算出的梯度值,主要针对设置了requires_grad=True的叶张量。梯度计算后可通过.grad访问偏导数。使用torch.no_grad()上下文管理器可禁用梯度追踪,适用于模型推理或冻结参数等场景,能减少内存消耗并提升计算效率。示例展示了梯度计算与禁用追踪的实际应用。

文章图片
#深度学习#人工智能#java
【Java深度学习】PyTorch On Java 系列课程 第三章 06 :张量自动微分【AI Infra 3.0】[PyTorch Java 硕士研一课程]

Autograd 自动微分摘要 PyTorch的Autograd系统通过动态构建计算图实现自动微分,有效支持神经网络的训练过程。该系统利用反向模式自动微分,基于链式法则自动计算损失函数对模型参数的梯度。关键特性包括: 动态计算图:在执行张量运算时实时构建有向无环图(DAG),支持Python控制流,便于调试。 梯度计算机制: 通过requires_grad=True标记需要计算梯度的张量 使用.b

文章图片
#深度学习#人工智能#java
【Java深度学习】PyTorch On Java 系列课程 第四章 09 :神经网络进阶【AI Infra 3.0】[PyTorch Java 硕士研一课程]

PyTorch中的nn.Sequential容器提供了一种简洁的方式来定义线性堆叠的神经网络模型。它适用于简单的前馈网络结构,如多层感知机(MLP),其中各层按顺序执行且无需复杂的数据流控制。通过直接传递模块或使用OrderedDict命名层,可以快速构建模型并提高代码可读性。nn.Sequential特别适合全连接网络和可复用模块的创建,简化了层间线性传递的模型定义过程。

文章图片
#深度学习#人工智能#java
【Java深度学习】PyTorch On Java 系列课程 第五章 11 :数据集高级 Dataloader【AI Infra 3.0】[PyTorch Java 硕士研一课程]

摘要 torch.utils.data.DataLoader 是PyTorch中高效处理数据集的核心工具,主要功能包括: 将数据分批处理(指定batch_size) 随机打乱数据(shuffle=True) 并行加载数据(多进程加速) 示例展示了如何为自定义DummyDataset创建DataLoader,其中包含105个样本(10维特征+二元标签),设置batch_size=32并进行训练迭代。

文章图片
#深度学习#人工智能#java
【Java深度学习】PyTorch On Java 系列课程 第五章 10 :数据集【AI Infra 3.0】[PyTorch Java 硕士研一课程]

本文摘要:PyTorch的torch.utils.data模块为解决深度学习中的高效数据处理提供了标准化方案。通过Dataset类可组织自定义数据,利用DataLoader实现批量加载、并行处理和内存优化。该模块有效解决了大型数据集的内存限制、I/O瓶颈、数据预处理、洗牌和批处理等挑战,使开发者能专注于模型构建而非数据管理细节。

文章图片
#深度学习#人工智能#java
【Java深度学习】PyTorch On Java 系列课程 第十四章 29 :PyTorch模型扩展自定义Module【AI Infra 3.0】[PyTorch Java 硕士研一课程】

摘要:本文介绍了如何使用自定义模块扩展PyTorch的torch.nn模块。通过继承torch.nn.Module类,开发者可以创建可重用的自定义层或网络组件。文章详细说明了自定义模块的核心构成:在__init__方法中初始化子模块、参数和缓冲区,并在forward方法中定义具体计算逻辑。示例代码展示了如何实现一个包含线性层、ReLU激活函数和自定义参数的基本模块,并演示了模块的初始化、正向传播以

文章图片
#深度学习#人工智能#java
    共 143 条
  • 1
  • 2
  • 3
  • 15
  • 请选择