logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

通义千问72B、1.8B、Audio模型发布,效仿Meta掀桌子

同时,在Qwen-1.8B的基础上,使用对齐机制打造了基于大语言模型的AI助手Qwen-1.8B-Chat。通义千问-72B(Qwen-72B)是阿里云研发的通义千问大模型系列的720亿参数规模的模型。同时,在Qwen-72B的基础上,使用对齐机制打造了基于大语言模型的AI助手Qwen-72B-Chat。兼容多种复杂音频的多任务学习框架:为了避免由于数据收集来源不同以及任务类型不同,带来的音频到文

文章图片
#语言模型#人工智能
Qwen-Image-Edit-2511-Multiple-Angles LoRA:多角度AI图像生成完全指南

摘要:Qwen-Image-Edit-2511-Multiple-AnglesLoRA是一款革命性的AI图像编辑工具,提供96种相机视角控制,包括8个方位角、4个仰角和3个距离级别。该技术基于3,000多张高质量渲染图训练,支持从单张输入图像生成多角度视图,特别适合电商产品展示和创意内容制作。用户只需通过自然语言提示词即可精确控制虚拟相机位置,无需复杂参数调整。该工具已集成到ComfyUI等平台,

文章图片
#人工智能#计算机视觉
中国电信星辰语义大模型-TeleChat:央企首家开源的7B级对话模型

TeleChat,这一由中国电信精心打造的7B级对话模型,利用了1.5万亿Tokens的中英文高质量语料进行训练。此次开源的TeleChat-7B-bot模型,集成了7B模型的int8和int4量化版本,旨在提供更高效的计算性能和更广泛的应用场景。Huggingface模型下载:AI快站模型免费加速下载:Tele-AI。

文章图片
#人工智能#语言模型#自然语言处理
Stable Video 3D震撼发布:3D生成引入视频扩散模型,4090可跑,权重全开放

近日,Stability AI携最新力作Stable Video 3D (SV3D) 强势登场,该模型基于先进的视频扩散技术,标志着3D生成技术的一大飞跃。与之前的Stable Zero123相比,SV3D在模型质量、功能强度上都有显著提升,真正实现了从单一图像到复杂3D模型的高效转换。

文章图片
#人工智能#自然语言处理#语言模型 +1
Qwen-Image-Edit-2511-Multiple-Angles LoRA:多角度AI图像生成完全指南

摘要:Qwen-Image-Edit-2511-Multiple-AnglesLoRA是一款革命性的AI图像编辑工具,提供96种相机视角控制,包括8个方位角、4个仰角和3个距离级别。该技术基于3,000多张高质量渲染图训练,支持从单张输入图像生成多角度视图,特别适合电商产品展示和创意内容制作。用户只需通过自然语言提示词即可精确控制虚拟相机位置,无需复杂参数调整。该工具已集成到ComfyUI等平台,

文章图片
#人工智能#计算机视觉
Sora视频水印终极解决方案:这款AI工具让你实现精准去除、高清无痕!

Sora2WatermarkRemover工具为AI视频创作者提供了专业级去水印解决方案。该工具通过"手动蒙版+AI智能修复"技术,支持用户精准标记水印区域,利用ComfyUI引擎智能填充内容,在保持原画质的同时完美去除水印。操作简单仅需"上传-框选-提交"三步,适用于影视制作、社交媒体创作等场景,为Sora视频的商业应用扫清障碍。云端处理不占用本地资源,是

文章图片
#人工智能#音视频
秒级生成、细节拉满!探索阿里巴巴 LHM 开源模型,人人都是 3D 建模师

LHM 以其惊人的速度、出色的细节还原能力和易用性,真正意义上革新了 3D 数字人的创建方式。它不仅是一个强大的技术工具,更是一个激发创意的平台,让“人人都是 3D 建模师”的愿景触手可及。

文章图片
#开源#3d#人工智能
Geneformer:计算生物学的大模型革新

近日,《Nature》杂志发表了关于Geneformer的研究,这是转录组计算生物学领域的第一个大模型。Geneformer基于约3000万个单细胞转录组的大规模语料库进行预训练,旨在网络生物学数据有限的情况下实现上下文特异性预测。Geneformer采用基于注意力的深度学习模型,通过迁移学习在有限数据的网络生物学中进行预测。它利用自注意力机制关注每个单细胞转录组中表达的基因,优化给定学习目标内的

文章图片
#人工智能#深度学习#语言模型
谷歌发布时序预测基础模型TimesFM,2亿参数,消费级GPU可运行,零样本时间序列预测新突破

时序数据在零售、金融、制造、医疗和自然科学等各个领域无处不在,而时序预测则是这些领域中一项至关重要的任务。近年来,深度学习模型在处理丰富、多变量的时序数据方面取得了显著进展,往往优于传统的统计方法,例如 ARIMA 或 GARCH。然而,大多数深度学习模型都需要经过漫长而复杂的训练和验证过程,才能在新的时序数据上进行测试。因此,对于需要快速部署和应用的实际场景,这些模型存在局限性。

文章图片
#transformer#深度学习#人工智能 +2
Qwen3-TTS 完整指南:开源文本转语音模型详解

阿里巴巴Qwen团队发布开源文本转语音模型Qwen3-TTS,提供1.7B和0.6B两个版本,支持10种语言和49+种音色。该模型具备3秒语音克隆、97毫秒低延迟等核心功能,性能优于竞品,采用Apache2.0许可可商用。硬件要求从4GB到12+GB VRAM不等,支持量化优化和微调,适用于内容创作、对话式AI等多种场景。

文章图片
#开源#人工智能#语言模型 +2
    共 131 条
  • 1
  • 2
  • 3
  • 14
  • 请选择