logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

小米自研语音合成声音定制技术:让世界听见你的声音!

你知道吗?在我国患有言语障碍及伴有言语障碍的人数超过3000万人次,他们很少能说出一句完整的话,只能发出个别字词的音节,很难与人进行正常的交流。为此,小米做了什么呢?小米AI实验室将自研的声音适配算法和超级拟人语音合成技术应用于无障碍领域,为一位言语障碍用户“阿卷”开发了独一无二的定制声音,取代了以往的普通电子机械音,让阿卷可以用“自己的声音”与外界交流。这是小米AI实验...

#算法#大数据#编程语言 +2
面向未来的散热技术!小米自研「环形冷泵散热系统」

随着手机性能的日益提升,做好散热也成为了保障体验的重中之重。石墨、热管、VC液冷,几年时间手机散热技术持续更迭。小米正式推出一项面向未来的散热技术:环形冷泵散热技术。它参考航天卫星散热方式...

#游戏#人工智能#游戏开发 +2
干货 | 足式机器人运动控制发展方向——轨迹优化

“运动控制技术的进步使得足式机器人的运动能力更强,而近来轨迹优化作为主流学术研究方向,能够为足式机器人运动控制的发展提供可能的指引。本期技术干货,我们邀请到了小米工程师徐喆,向我们介绍足式机器人运动控制的发展方向——轨迹优化。”一、前言足式机器人的运动控制技术在近几十年取得了巨大的发展,80年代Marc Raibert提出的经典三分控制方法,实现了高动态的运动,也为后来Boston Dynamic

#大数据#算法#编程语言 +2
Xiaomi Miloco 发布,探索大模型驱动全屋智能生活

而探索方案的核心目标,是为家庭赋予一个能理解生活细节的 “AI 大脑”—— 它可保存 “雨天关窗”“睡前调温” 等场景偏好,能读懂 “想睡个好觉” 背后对温度、光线、噪音的综合需求,更能实现跨生态设备协作,在持续交互中优化体验,真正做到越用越贴心。Miloco 的全屋智能差异化体验,依托于 Xiaomi MiMo-VL-Miloco-7B 端侧视觉语言大模型与四层完整架构的坚实支撑,从交互、感知、

#生活
小米技术新突破!具身大模型 MiMo-Embodied 正式发布并全面开源

作为业界首个成功打通自动驾驶与具身智能的跨域具身基座模型,它实现了两大领域任务的统一建模,标志着通用具身智能研究从 “垂直领域专用” 向 “跨域能力协同” 迈出关键一步。为推动社会对通用具身智能范式的进一步探索,该模型现已全面开源。跨域能力覆盖:同步支持具身智能三大核心任务(可供性推理、任务规划、空间理解)与自动驾驶三大关键任务(环境感知、状态预测、驾驶规划),形成全场景智能支撑;通用视觉语言领域

DeepLight X AgentMat: 小米与上海交大联合发布轻合金大模型多智能体设计平台

未来,双方将持续深化合作,进一步拓展轻合金大模型的应用场景,完善多智能体协作机制,加快形成人工智能驱动、人机协同的材料研发新范式,以智能科技赋能材料创新,在钛合金、高温高熵合金等更多相关新材料领域实现技术突破,深入贯彻实施“人工智能+”行动计划,助力 AI+新质生产力跃迁。针对轻合金材料设计方法面临的组分工艺复杂、研发生产应用流程长,评价维度多样等难点,小米集团正式联合上海交通大学发布轻合金大模型

#人工智能
小米开源首代机器人 VLA 大模型,刷新多项 SOTA!

现有的 VLA(Vision-Language-Action)模型虽然通过大规模参数获得了惊人的泛化能力,但在真实物理世界中,庞大的推理延迟往往让机器人表现得像个“反应迟钝的木头人”。模型保留了 VLM 本身的多模态理解能力,尤其是在具身更相关的 benchmark 中表现优异,这是之前的 VLA 模型所不具备的。这种“大脑+小脑”的组合,让我们的模型既能听懂指令,又能像人类一样,在动作执行时保持

#机器人
多篇论文入选国际顶会 CVPR 2026!小米大模型、自动驾驶等技术实现创新突破

近日,CVPR 2026(IEEE/CVF Conference on Computer Vision and Pattern Recognition,简称 CVPR)公布了论文录用结果。小米共有14篇最新研究成果成功入选,涵盖了长视频理解/推理、多模态情感推理、GUI Agent、主动意图决策、场景高斯重建、场景视频生成、仿真框架、扩散模型应用、具身智能等方向。这是小米大模型、自动驾驶等部分研究

#自动驾驶#人工智能#机器学习
Xiaomi MiMo-V2.5 系列大模型开启公测

内部测试中,MiMo-V2.5-Pro 展现出的智能水平让我们重新思考人与模型的协作方式:搭配合适的运行框架,它可以稳定完成单次涉及近千轮工具调用的长程任务,在智能体场景下的指令遵循能力也明显提升——既能精准捕捉上下文中的隐性要求,又能在超长周期内保持逻辑一致。Xiaomi MiMo-V2.5 系列包含 MiMo-V2.5、V2.5-Pro 、V2.5-TTS Series 、V2.5-ASR。M

目标说话人识别大模型,让车外语音“聚精会神”听懂你

大模型更容易理解简洁的符号,而不是精确的小数——就像人类在嘈杂环境中判断"像不像"时,用"很像/有点像/不太像"来描述,远比"相似度 0.83"更直觉。通过这种"先记住你,再只听你"的方式,即使旁边有人大声聊天、即使周围人声鼎沸,你的新一代 SU7 也能精准识别你的指令,对其他人的声音或指令充耳不闻。有了移动拾音技术加持,在车外下达语音指令时,你可以边走边说,识别算法始终跟着你、听懂你,让车外语音

    共 133 条
  • 1
  • 2
  • 3
  • 14
  • 请选择