logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

摩尔线程MTVSR视频超分技术合入VLC开源社区

性能方面,MTVSR通过MUSA内核调用GPU实现硬件推理加速,目前,用户使用摩尔线程MTT S80/S70系列显卡,并安装最新官方驱动(v340.150或后续版本),即可在VLC nightly build版本中抢先体验MTVSR超分功能,该技术也将随VLC 3.0.24稳定版正式发布,覆盖更广泛的用户群体。与传统播放器常用的双三次插值或Lanczos算法不同,MTVSR采用基于深度学习的实时智

文章图片
#音视频#开源
Day-0支持|摩尔线程TileLang-MUSA率先支持DeepSeek-V4全新TileKernels

摩尔线程宣布其TileLang-MUSA成为TileLang官方主线版本,实现对DeepSeek-V4最新TileLang算子库TileKernels的"Day-0"支持,为国产GPU上的大模型算子迁移和优化奠定基础。TileLang-MUSA已开源,测试覆盖率超95%,显著提升国产GPU开发效率。这一进展标志着国产AI大模型与GPU深度融合,摩尔线程将持续投入开源生态建设,推

文章图片
摩尔线程 × 上海AI实验室|基于S5000和KernelSwift实现DeepSeek-V4核心算子Day-0适配

DeepSeek-V4预览版发布当天,摩尔线程通过智能算子迁移系统KernelSwift,在MTTS5000智算卡上实现了80%以上核心算子的Day-0适配。KernelSwift将适配周期从数月缩短至小时级,支持多元国产芯片的"开箱即用"。MTTS5000凭借原生FP8精度支持,为模型提供高效算力底座。经协同优化,21个核心算子均获加速,自动生成算子正确率达100%,展现了国

文章图片
#人工智能
Day-0支持|摩尔线程TileLang-MUSA率先支持DeepSeek-V4全新TileKernels

摩尔线程宣布其TileLang-MUSA成为TileLang官方主线版本,实现对DeepSeek-V4最新TileLang算子库TileKernels的"Day-0"支持,为国产GPU上的大模型算子迁移和优化奠定基础。TileLang-MUSA已开源,测试覆盖率超95%,显著提升国产GPU开发效率。这一进展标志着国产AI大模型与GPU深度融合,摩尔线程将持续投入开源生态建设,推

文章图片
摩尔线程MUSACODE:重塑国产GPU开发工作流的AI编程智能体

与通用AI编程工具不同,MUSACODE的定位是工程交付Agent——它不只补全代码片段,更能完整驱动从项目分析、代码生成到调试重构、算子优化与交付的全链路开发流程。在开发体验上,MUSACODE坚持“高效与可控并重”:需要修改文件或执行命令的操作会先请求确认,关键修改可审阅(Diff)、可回退,让AI既能放手干活,又始终处于可控范围内。,它以自然语言为入口,由AI Agent驱动整个开发流程——

文章图片
#大数据#人工智能
MUSA开发者大赛丨算子挑战赛S2赛季正式开启!

从ChatGPT到国产大模型的快速迭代,每一次模型能力的跃升,都依赖算力规模与效率的双重突破。国产算力硬件底座已初步成型,但真正释放芯片潜能,仍高度依赖于软件栈的深度优化——硬件决定理论峰值,软件决定可达性能,未经极致调优的算子与运行时环境,难以将纸面算力转化为实际有效吞吐。作为大模型训练与推理中最核心的计算载荷,GEMM同时考验计算单元的利用效率、访存系统的带宽供给能力,以及二者之间的协同调度水

文章图片
从代码合入到社区共聚:SGLang × MUSA Meetup圆满落幕,国产GPU开源生态进入“原生支持”时代

目前,基于MUSA的SGLang已支持DeepSeek、Qwen、GLM等主流大模型及Wan、LTX等视频生成模型,在MTT S5000等硬件上实现真正的“开箱即用”与无缝加速,显著降低了开发者的算力迁移门槛。通过与SGLang、TileLang、Triton、Mooncake等开源社区的紧密协作,摩尔线程不仅推动了MUSA平台与主流AI框架的深度适配,更。,未来12个月应优先建立跨层级的统一抽象

文章图片
#sglang#开源
摩尔线程开源MusaCoder:面向GPU底层算子生成的专用代码大模型

这一开源举措将有助于提升MUSA在AI开发者社区的可见度,推动MUSA Kernel、编译工具链及运行时生态建设,吸引社区围绕MUSA进行算子优化、KernelBench适配和代码生成模型微调等工作,全面展示摩尔线程在国产GPU、大模型训练、执行反馈强化学习和AI编程工具链方向的综合能力。随着大模型代码生成能力不断提升,行业对代码模型的评估重心正在发生变化:从过去关注“语法是否正确”“能否写出完整

文章图片
#开源
摩尔线程与xLLM推理引擎深度协同 国产AI算力生态再添里程碑

xLLM是一款开源的大模型推理引擎,专为国产AI加速芯片深度优化,已在某电商零售核心业务中完成大规模生产环境验证。不同于vLLM、SGLang等基于Python生态的主流框架,xLLM选择了一条从零构建的技术路线——以C++重构推理引擎核心,从系统层面突破性能瓶颈,而非在现有Python框架上做增量优化。本次性能测试基于MTT S5000单卡环境,在三种典型输入/输出长度配置(2.5k-1k、3.

文章图片
#人工智能
摩尔线程MUSACODE:重塑国产GPU开发工作流的AI编程智能体

与通用AI编程工具不同,MUSACODE的定位是工程交付Agent——它不只补全代码片段,更能完整驱动从项目分析、代码生成到调试重构、算子优化与交付的全链路开发流程。在开发体验上,MUSACODE坚持“高效与可控并重”:需要修改文件或执行命令的操作会先请求确认,关键修改可审阅(Diff)、可回退,让AI既能放手干活,又始终处于可控范围内。,它以自然语言为入口,由AI Agent驱动整个开发流程——

文章图片
#大数据#人工智能
    共 38 条
  • 1
  • 2
  • 3
  • 4
  • 请选择