logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

Python ORM神器之SQLAlchemy基本使用完全指南

SQLAlchemy是Python中最流行的ORM框架,提供了优雅的数据库操作方式。文章介绍了SQLAlchemy的核心概念(Engine、Session、Model)、基本使用方法(安装、模型定义、数据增删改查)以及高级特性(事务管理、上下文管理器、连接池配置)。通过SQLAlchemy,开发者可以用面向对象的方式操作多种数据库,避免直接编写SQL语句,提高开发效率和代码可维护性。文章包含详细代

#python#开发语言
十六、用 GPT2 中文古文模型实现经典名句续写

本文介绍了基于GPT2中文古文模型实现经典名句自动续写的方法。通过微调《论语》《诗经》等古籍语料的gpt2-chinese-ancient模型,AI能够理解古文的语义逻辑和语言风格。文章详细讲解了环境准备、核心代码实现及参数调优技巧,如设置temperature=0.6控制随机性、top_k=30保证用词准确性等优化策略。典型输出示例展示了模型能生成符合儒家语境、句式工整的续写内容。该方法可扩展应

#人工智能#深度学习
十五、基于 GPT2 中文模型实现歌词自动续写

本文介绍了如何利用GPT2中文歌词生成模型实现文本自动续写功能。首先分析了GPT2模型的因果语言特性及其在中文文本生成中的优势,然后详细讲解了环境配置、模型加载和核心代码实现过程。文章重点解析了TextGenerationPipeline的使用方法,并提供了参数调优、GPU加速等优化技巧,以提升生成质量和效率。最后探讨了该技术在歌词创作、诗歌生成等场景的扩展应用,展示了GPT2作为轻量化中文文本生

#深度学习#人工智能
十七、用 GPT2 中文对联模型实现经典上联自动对下联:

本文介绍了基于GPT2中文对联模型实现自动对联生成的技术方法。通过分析GPT2-chinese-couplet模型的代码实现,详细讲解了从环境配置、模型加载到对联生成的全流程。该模型在海量对联语料上微调,能够理解对联的"对仗工整、平仄协调、意境相符"规则。以"青山不墨千秋画"为例,展示了如何通过调整温度参数、采样范围等关键参数生成"绿水无弦万古琴&

#人工智能#深度学习
十九、基于轻量级 GPT2-Distil 中文模型实现文本续写:从代码到实战

本文介绍了轻量级GPT2中文模型gpt2-distil-chinese-cluecorpussmall的使用方法,该模型具有体积小、速度快、适配中文等优势。文章详细讲解了从环境准备到代码实现的完整流程,包括模型加载、分词器配置、文本生成参数优化等关键步骤。重点分析了max_new_tokens、temperature等核心参数的作用及调优技巧,并提供了批量续写和风格定制的拓展应用示例。该轻量级模型

#人工智能#深度学习
二十、使用PyTorch和Hugging Face Transformers训练中文GPT-2模型的技术实践

本文详细介绍了基于GPT2模型的中文诗歌生成训练全流程。首先通过自定义Dataset类加载和清洗诗歌文本数据,然后使用HuggingFace Transformers库加载GPT2预训练模型和分词器。重点讲解了批量数据处理函数collate_fn的实现,以及包含梯度裁剪、学习率调度等优化技术的训练流程搭建。文章还提供了训练指标监控、模型保存等核心代码实现,并对训练过程中的关键参数设置和优化方向进行

#pytorch#人工智能
十八、基于 Transformers 库调用 GPT2 中文诗歌模型实现文本续写实战

本文介绍了如何使用HuggingFace的Transformers库实现中文诗歌文本续写。首先需要配置开发环境并下载GPT2中文诗歌模型。核心步骤包括:加载BertTokenizer分词器和GPT2LMHeadModel模型,创建TextGenerationPipeline文本生成管道,配置关键参数如max_new_tokens、temperature等控制续写长度和创造性。通过调整这些参数可以优

#人工智能#深度学习
LMDeploy安装及部署 Qwen/Qwen3-0.6B教程

LMDeploy是上海人工智能实验室开源的大模型部署工具箱,支持轻量化、高性能的模型量化、推理及API服务。其特点包括高效推理(性能达vLLM的1.8倍)、可靠量化(4bit推理效率为FP16的2.4倍)以及便捷的多模型服务。教程详细介绍了从环境配置(CUDA 12.2、Python 3.8+)到部署Qwen3-0.6B模型的完整流程,包括模型下载、虚拟环境创建、API服务启动(lmdeploy

文章图片
gradio学习代码部分

gr.File(label="上传文件",file_types=["image", "video", "audio", "text", "pdf"])dropdown = gr.Dropdown(choices=["选项1", "选项2", "选项3"], label="选择选项")dropdown = gr.Dropdown(choices=["选项1", "选项2", "选项3"], labe

#java#前端#javascript
vLLM 安装及部署 Qwen/Qwen3-0.6B教程

vLLM是加州伯克利团队开发的高性能大语言模型推理引擎,通过PagedAttention技术优化内存管理,支持多GPU分布式推理,显著提升吞吐量。本文以Ubuntu系统为例,演示如何在12G显存GPU上部署轻量级Qwen3-0.6B模型:先安装CUDA12.2和Python3.8+环境,通过ModelScope下载FP8格式模型,创建conda虚拟环境后安装vLLM,最后启动API服务并测试。该方

文章图片
    共 105 条
  • 1
  • 2
  • 3
  • 11
  • 请选择