logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

健身 Agent:不止视频,更有 AI 人物实时跟练交互

在健身领域,大量应用仍停留在单向视频播放、静态指令推送的浅层应用层面:仅实现课程推送、文字任务下发,缺少真人化实时交互,无法动态指导、情绪陪伴,用户全程被动跟练,极易中途放弃。真正落地可用的健身 Agent,核心突破在于叠加 3D 具身数字人实时交互能力:以 Agent 逻辑完成训练任务规划、动作识别、数据闭环,同时依托 AI 人物实现实时动作示范、节奏引导、情绪鼓励陪伴,让训练从被动观看,升级为

文章图片
#音视频#人工智能#交互
给 AI 赋予 “身体”:魔珐星云具身智能数字人(SDK 接入 + 多场景落地)

魔珐星云是魔珐科技推出的具身智能 3D 数字人开放平台,核心使命是为 AI 赋予 “身体” 与 “表达能力”。与传统数字人平台不同,它不只是提供单一的数字人形象,而是通过全栈式技术封装,让开发者无需关注复杂的 3D 渲染、动作生成等底层逻辑,只需简单调用 SDK,就能让大模型具备语音、表情、动作兼备的多模态交互能力。星云具身驱动能力,将 AI 的表达从“文本”升级为“ 3D 多模态”。它可基于文本

文章图片
#人工智能
国产大模型进入展厅:魔珐星云让 DeepSeek 讲解能力具象落地

回看整个搭建过程,这个 Demo 完成的并不只是“让 DeepSeek 驱动一个数字人说话”。如果只是将大模型输出接入 TTS,让页面播放一段语音,其实很快就能完成。但那种方案依旧停留在文本问答的延伸形态:模型负责生成,语音负责朗读,屏幕上的形象与整个对话过程没有形成真正的协同。这次接入魔珐星云 SDK 后,DeepSeek 生成的讲解内容能够继续转化为数字人的语音、口型、表情和身体动作;当讲解涉

文章图片
#人工智能
从零开发 AR 演讲提词器:基于 Rokid CXR-M SDK 的实战指南

这款演讲提词器利用 Rokid AR 眼镜的 WORD_TIPS 场景,实现了"隐形提词"的效果。场景化设计:SDK 预置的场景类型降低了开发难度,开发者只需关注业务逻辑流式传输sendStreamAPI 设计简洁,适合分页内容的实时推送连接管理:蓝牙连接的复杂性被封装在 SDK 内部,回调机制清晰AR 眼镜在办公场景有着广阔的应用空间。除了演讲提词,还可以用于实时翻译、会议记录、远程协助等场景。

文章图片
#ar
国产大模型进入展厅:魔珐星云让 DeepSeek 讲解能力具象落地

回看整个搭建过程,这个 Demo 完成的并不只是“让 DeepSeek 驱动一个数字人说话”。如果只是将大模型输出接入 TTS,让页面播放一段语音,其实很快就能完成。但那种方案依旧停留在文本问答的延伸形态:模型负责生成,语音负责朗读,屏幕上的形象与整个对话过程没有形成真正的协同。这次接入魔珐星云 SDK 后,DeepSeek 生成的讲解内容能够继续转化为数字人的语音、口型、表情和身体动作;当讲解涉

文章图片
#人工智能
我用 Doubao-Seed-Evolving 做了一个我的世界,被成品惊到了......

本次通过 TRAE AI IDE 与 Doubao-Seed-Evolving 大模型,以轻量化 Vibe Coding 的方式,仅通过自然语言描述需求,就从零完成了 Three.js 版我的世界网页游戏的开发。

文章图片
#人工智能
用飞算JavaAI 做课程设计:我一周做出了能跑的蚂蚁智能项目管理平台

当我在浏览器里打开自己做的 “蚂蚁智能项目管理平台” 首页 —— 左侧导航栏整整齐齐列着 “项目管理”“我的任务”“流程管理”,中间区域的 “项目总数”“任务总数” 卡片清晰展示着数据,右侧还有任务状态的环形统计图表时,我盯着屏幕愣了好一会儿:这是一个刚学 Java 半年的大二学生能做出来的成品?毕竟一周前,我还在为 “怎么把项目数据和可视化图表连起来” 翻遍 ECharts 的文档,连一个简单的

文章图片
#人工智能
openGauss 作为 RAG 向量数据库的深度测评

作为一名长期关注向量数据库和 RAG(检索增强生成)技术的开发者,我最近对 openGauss 7.0 的向量能力进行了深入测试。openGauss 作为开源数据库,在 AI 场景下的向量特性一直备受关注。本文将从实际使用角度,分享我在构建 RAG 系统过程中的真实体验。

文章图片
#数据库
给 AI 赋予 “身体”:魔珐星云具身智能数字人(SDK 接入 + 多场景落地)

魔珐星云是魔珐科技推出的具身智能 3D 数字人开放平台,核心使命是为 AI 赋予 “身体” 与 “表达能力”。与传统数字人平台不同,它不只是提供单一的数字人形象,而是通过全栈式技术封装,让开发者无需关注复杂的 3D 渲染、动作生成等底层逻辑,只需简单调用 SDK,就能让大模型具备语音、表情、动作兼备的多模态交互能力。星云具身驱动能力,将 AI 的表达从“文本”升级为“ 3D 多模态”。它可基于文本

文章图片
#人工智能
健身 Agent:不止视频,更有 AI 人物实时跟练交互

在健身领域,大量应用仍停留在单向视频播放、静态指令推送的浅层应用层面:仅实现课程推送、文字任务下发,缺少真人化实时交互,无法动态指导、情绪陪伴,用户全程被动跟练,极易中途放弃。真正落地可用的健身 Agent,核心突破在于叠加 3D 具身数字人实时交互能力:以 Agent 逻辑完成训练任务规划、动作识别、数据闭环,同时依托 AI 人物实现实时动作示范、节奏引导、情绪鼓励陪伴,让训练从被动观看,升级为

文章图片
#音视频#人工智能#交互
    共 70 条
  • 1
  • 2
  • 3
  • 7
  • 请选择