logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

在Node.js服务中集成Taotoken实现稳定高效的大模型调用

在Node.js服务中集成Taotoken实现稳定高效的大模型调用 对于需要构建后端AI服务的Node.js开发者而言,直接对接多个大模型厂商的API会面临一些工程挑战。不同厂商的API端点、认证方式和错误处理逻辑各异,当某个服务出现临时波动时,切换备用模型往往意味着需要修改代码和配置。Taotoken作为一个提供OpenAI兼容API的聚合平台,可以帮助开发者将这些差异统一起来。本文将介绍如何在

DeepAnalyze与SpringBoot集成实战:构建智能数据分析微服务

本文介绍了如何在星图GPU平台上自动化部署🔬 DeepAnalyze - 深度文本分析引擎镜像,实现智能文本数据分析能力。通过SpringBoot微服务封装,用户可上传销售、运营等结构化数据文件,5分钟内自动生成含趋势洞察、异常检测与业务建议的分析报告,广泛应用于电商周报、客户行为分析等典型场景。

#微服务
StructBERT情感分类模型与大数据平台集成方案

本文介绍了如何在星图GPU平台上自动化部署StructBERT情感分类-中文-通用-base镜像,实现高效的中文文本情感分析。该方案能处理电商评论、社交媒体等海量数据,自动识别用户情感倾向,为企业提供实时市场洞察和用户体验优化支持。

音诺ai翻译机检测ESP32-S3与关键词spotting实现语音唤醒

本文深入探讨了基于ESP32-S3平台的嵌入式语音唤醒系统设计,涵盖MFCC特征提取、轻量级CNN与DS-CNN模型构建、TFLite Micro部署优化及多语言关键词检测实现,提出低功耗、高精度的边缘AI解决方案。

为什么顶尖公司都在用vLLM做生产级大模型服务?

vLLM通过PagedAttention、连续批处理和OpenAI兼容API,显著提升大模型推理吞吐与显存利用率,降低部署成本。其支持量化、流式输出与无缝迁移,已成为阿里、字节等顶尖公司生产环境的核心组件,助力实现高效、可扩展的LLM服务。

#vLLM
Miniconda环境下部署Yi-34B大模型的资源规划

本文介绍在Miniconda环境下部署Yi-34B大模型的完整资源规划方案,涵盖显存、内存、磁盘及依赖管理要求。通过conda环境隔离、国内源加速、多卡推理配置和量化优化,实现高效、可复现的模型部署,适用于A6000/H100等高性能GPU场景。

边缘计算场景下EmotiVoice的推理性能测试报告

EmotiVoice 实现了在资源受限的边缘设备上进行低延迟、高表现力的语音合成,支持零样本音色克隆与多情绪控制,兼顾隐私保护与本地化部署,适用于智能家居、车载系统等场景。

#边缘计算
Langchain-Chatchat DevOps运维知识整合实践

利用Langchain-Chatchat将企业内部技术文档转化为安全可控的智能问答系统,实现故障排查、新人培训等场景下的高效知识获取。通过本地大模型与向量检索结合,确保数据不出内网的同时,提升运维响应速度与组织知识沉淀能力。

轻量化部署方案出炉:Linly-Talker适配边缘计算设备

Linly-Talker实现大模型在Jetson等边缘设备上的轻量化部署,集成ASR、LLM、TTS与面部动画驱动,支持语音克隆与本地化推理,在低延迟、高隐私场景下展现强大实用性,推动数字人走向千行百业。

#边缘计算
LangFlow能否接入私有化部署的大模型?内网调用实测

在内网环境中,LangFlow可无缝对接私有大模型,只需模型兼容OpenAI API格式即可。通过可视化拖拽操作,业务人员无需编程也能快速构建AI流程,提升企业AI落地效率,同时保障数据安全。

    共 864 条
  • 1
  • 2
  • 3
  • 87
  • 请选择