logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

国家超算互联网:赋能AI大模型的算力引擎【活动福利】

国家超算互联网平台是一个创新的算力网络和服务平台,旨在将全国众多超算中心连接起来,构建一体化的超算算力网络。这一平台的建设背景源于对现有单体超算中心运营模式的突破需求,以及对算力设施分布不均衡、接口不统一等问题的解决。它的诞生标志着我国在算力资源统筹调度和应用方面迈出了重要一步。国家超算互联网平台的上线,不仅为AI大模型等前沿技术提供了强大的算力支持,也为数字中国建设注入了新的活力。我们期待这一平

文章图片
#人工智能#程序人生
国家超算互联网:赋能AI大模型的算力引擎【活动福利】

国家超算互联网平台是一个创新的算力网络和服务平台,旨在将全国众多超算中心连接起来,构建一体化的超算算力网络。这一平台的建设背景源于对现有单体超算中心运营模式的突破需求,以及对算力设施分布不均衡、接口不统一等问题的解决。它的诞生标志着我国在算力资源统筹调度和应用方面迈出了重要一步。国家超算互联网平台的上线,不仅为AI大模型等前沿技术提供了强大的算力支持,也为数字中国建设注入了新的活力。我们期待这一平

文章图片
#人工智能#程序人生
【AI大模型前沿】Depth Anything 3:字节跳动推出的高效视觉空间重建模型

Depth Anything 3(DA3)是字节跳动Seed团队推出的一种视觉空间重建模型,能够从任意数量的视觉输入(包括单张图片、多视角图像或视频流)中恢复出三维空间的几何结构。该模型采用单一的Transformer架构,无需复杂的多任务训练或定制化架构设计,通过“深度-射线”表征法,实现了从单目深度估计到多视角几何重建的统一。

文章图片
#人工智能#AIGC#开源 +2
【AI大模型前沿】DeepSeek-Math-V2:数学推理的智能助手,从定理证明到竞赛夺冠

DeepSeek-Math-V2 是一个专注于数学推理的开源大语言模型,由 DeepSeek 团队开发。它基于 DeepSeek-V3.2-Exp-Base 构建,采用验证器 - 生成器协同进化的训练方式,通过自我验证机制显著提升了数学定理证明和推理的严谨性。该模型在国际数学奥林匹克竞赛(IMO)、中国数学奥林匹克竞赛(CMO)和普特南数学竞赛(Putnam)等权威基准测试中表现出色,接近满分水平

文章图片
#人工智能#AIGC#开源 +1
【AI大模型前沿】GLM-ASR:智谱开源的高性能语音识别模型

GLM-ASR是由智谱AI开发的开源语音识别模型系列,包括云端的GLM-ASR-2512和开源的GLM-ASR-Nano-2512。该系列模型基于深度学习架构,针对语音识别任务进行优化,不仅在理想环境下表现出色,更注重在复杂声学环境下的鲁棒性。GLM-ASR-Nano-2512采用1.5B参数,通过特定的训练策略,覆盖多噪声、多口音、低音量以及中文方言等复杂语音样本,使其在实际应用中表现出色。

文章图片
#人工智能#开源#语音识别 +3
【AI大模型前沿】ERNIE 4.5:百度文心大模型的多模态技术革新与应用实践

ERNIE 4.5 是百度文心推出的新一代大型多模态基础模型家族,包含多种不同变体,涵盖从 0.3 亿到 470 亿参数的模型。它采用异构混合专家架构(MoE),将参数分为文本、视觉和共享专家,通过模态隔离路由机制实现高效的多模态处理。ERNIE 4.5 在多模态任务和文本任务中均表现出色,尤其在视觉推理、文档理解等高难度任务上优势显著。此外,它还支持多语言交互、长文本处理和图像思考功能,广泛应用

文章图片
#人工智能#百度#开源 +2
【AI大模型前沿】Bee:腾讯混元与清华联合开源的全栈多模态大模型创新项目

Bee是由腾讯混元团队与清华大学联合推出的全栈开源多模态大模型解决方案,旨在通过提升数据质量来缩小开源模型与闭源模型之间的性能差距。该项目包含三大核心成果:首先是1500万规模的高质量双层CoT数据集Honey-Data-15M,它经过多步清洗和双层思维链扩充,覆盖多模态理解与生成任务,显著提升了数据的准确性和推理深度;其次是开源的数据增强工具HoneyPipe及DataStudio,为开发者提供

文章图片
#人工智能#开源#AIGC +2
【AI大模型前沿】InfinityStar:字节跳动推出的高效视频生成模型,开启视频创作新纪元

InfinityStar是由字节跳动(FoundationVision)推出的一款高效视频生成模型。它通过统一的时空自回归框架,实现了高分辨率图像和动态视频的快速合成。该模型采用纯离散方法,将视频分解为序列片段,有效解耦外观和动态信息,从而提升生成效率。InfinityStar不仅支持文本到图像、文本到视频等多种生成任务,还能在单GPU上实现分钟级生成720p视频,是视频生成领域的重要进展。

文章图片
#人工智能#开源#AIGC +2
【AI大模型前沿】Meta SAM 3D:从单图到3D世界的神奇钥匙

SAM 3D是Meta公司基于SAM系列推出的一款先进的3D重建模型,包含SAM 3D Objects和SAM 3D Body两个子模型。SAM 3D Objects能够从单张图像重建出物体和场景的详细3D模型,具备多视角一致性和复杂场景处理能力;SAM 3D Body则专注于人体姿态、骨骼和网格的高精度恢复,即使在非标准姿势、遮挡和部分出画等复杂情况下也能表现出色。

文章图片
#人工智能#3d#AIGC +1
【AI大模型前沿】Meta SAM 3:基于概念提示的图像与视频分割模型

Segment Anything Model 3(SAM 3)是由 Meta 开发的最新一代视觉分割模型,能够基于文本、图像示例或视觉提示(如点、框)在图像和视频中检测、分割和跟踪对象。与前代模型相比,SAM 3 引入了可提示概念分割(Promptable Concept Segmentation, PCS)功能,能够处理开放词汇的概念提示,一次性返回所有匹配对象实例的分割掩码和唯一身份标识。该模

文章图片
#人工智能#开源#AIGC +2
    共 251 条
  • 1
  • 2
  • 3
  • 26
  • 请选择