logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

基于RTX4090的Megatron-Turing大模型提升广告文案生成效果调优

本文探讨基于RTX4090部署Megatron-Turing大模型进行广告文案生成的调优方法,涵盖模型压缩、LoRA微调、推理加速与评估闭环,实现高效可控的内容生产。

经典Flash打地鼠游戏完整项目实战(AS3实现)

Flash曾是网页互动内容和小游戏开发的重要技术平台,尤其在2000至2010年代广泛应用于在线动画、广告及休闲游戏领域。打地鼠作为经典益智类小游戏,其核心机制简单明了——玩家通过点击随机冒出的地鼠获取分数,在限定时间内尽可能提高命中率。本章将从宏观角度介绍基于Flash平台开发此类游戏的技术背景与整体架构。我们将在后续章节中使用。

在 Node.js 后端服务中集成 Taotoken 调用大模型 API

在 Node.js 后端服务中集成 Taotoken 调用大模型 API 1. 准备工作 在开始集成 Taotoken 之前,请确保已具备以下条件: 拥有有效的 Taotoken API Key(可在控制台创建) 已安装 Node.js 16 或更高版本 了解基本的异步编程概念 建议将 API Key 存储在环境变量中而非硬编码在代码里。可以通过 .env 文件管理敏感信息: # .env TAO

使用taotoken后matlab调用大模型的延迟与稳定性体验

使用taotoken后matlab调用大模型的延迟与稳定性体验 作为一名频繁使用MATLAB进行算法开发和数据分析的研究者,我经常需要调用大语言模型来辅助代码生成、文档解释或进行数据洞察。过去,直接对接不同厂商的API面临着配置繁琐、网络环境不稳定以及成本不透明等问题。近期,我开始使用Taotoken平台作为统一的模型调用入口,本文将分享从MATLAB这一特定开发环境接入后的实际使用感受。 1.

Unity3D集成深度学习模型:游戏AI开发新范式

本文介绍了如何在星图GPU平台上自动化部署深度学习项目训练环境镜像,高效支撑Unity3D游戏AI开发。该镜像可快速构建模型训练与推理环境,典型应用于智能NPC行为生成——通过实时分析玩家操作数据动态调整战术决策,显著提升游戏交互真实感与适应性。

#深度学习
大模型定制新利器:Llama-Factory支持LoRA、QLoRA高效微调全流程

本文介绍如何通过Llama-Factory框架结合LoRA与QLoRA技术,在消费级GPU上高效微调7B至65B参数的大语言模型。涵盖显存优化、多任务复用、低秩适配原理及生产部署流程,显著降低大模型定制门槛。

基于大模型的数字人系统:Linly-Talker技术深度解析

Linly-Talker通过融合大模型、语音识别、语音合成与面部驱动技术,实现低成本、高拟真的数字人生成。系统支持实时交互与批量输出,具备多语言理解和语音克隆能力,结合Wav2Lip实现精准唇形同步,推动虚拟主播、智能客服等场景落地。

Dify支持国产大模型适配情况汇总

Dify作为开源AI开发平台,通过模型驱动架构实现对通义千问、ChatGLM、Baichuan等主流国产大模型的无缝集成,支持拖拽式构建智能体与一次编排多端运行。其抽象工厂设计屏蔽接口差异,助力企业构建安全可控的AI应用,已在金融、政务等领域落地。

高效训练大模型:TensorFlow + GPU算力组合方案

通过TensorFlow与GPU的深度协同,实现大模型高效训练。利用分布式策略、混合精度、XLA编译等技术,显著提升训练速度与资源利用率,构建从开发到生产的完整MLOps闭环,已在多个工业场景中验证其稳定性与扩展性。

Gemma-3-12B-IT部署实战:混合云环境(本地GPU+公有云存储)架构设计

本文介绍了如何在星图GPU平台上自动化部署gemma-3-12b-it高性能开源大语言模型(LLM)WebUI镜像,构建一个混合云架构的私有AI助手。该方案将计算密集的模型推理部署于本地GPU以保证性能与安全,同时利用云端存储管理模型与数据,显著降低了长期运营成本,适用于智能对话、内容生成等场景。

    共 830 条
  • 1
  • 2
  • 3
  • 83
  • 请选择