
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
2026年9月,Meta推出私人AI代理Muse,发布10天内登顶美国iPhone免费榜,日均下载超20万。与ChatGPT不同,Muse能自主执行任务——订票、谈判、发邮件,真正“替你做事”。其背后是Meta豪掷143亿美元布局的MuseSpark模型,由前ScaleAI CEO领导研发。虽功能强大,但引发隐私担忧:用户需授权大量数据,且亚马逊迅速封禁Muse购物,凸显平台与AI代理的冲突。安全

2026年9月,Jev与Laya的问世标志着AI从“聊天”转向“决策”的关键转折。二者均非生成式模型,而是专精于结构化判断的“系统一模型”,以毫秒级响应、低成本完成分类、路由等任务,颠覆大模型“用航母打苍蝇”的低效模式。Jev由ChatGPT联合创始人推出,闭源商用;Laya则开源免费,性能强劲,引发“开放vs封闭”之争。两者共同指向未来:企业AI将不再依赖通用大模型,而是由高效、专用的决策引擎驱

Onlook 作为一款开源的视觉编程工具,彻底改变了这一现状。它允许用户通过直观的拖拽界面编辑 React 网站,并实时将更改同步到代码中,为创作者提供了一个高效、易用的创作平台。

2689张真实家庭场景照片组成的HomeObjects-3K数据集,由Ultralytics发布,专为提升AI在室内环境的感知能力而设计。涵盖床、沙发、台灯等12类家居物品,助力扫地机器人、AR眼镜、智能家居系统更精准识别空间布局与物体位置。数据集采用YOLO格式,支持一键训练,390MB体积适配边缘设备,推动家庭场景视觉理解迈向标准化。

微软的TTS模型只有针对新用户免费一年,其他用户都是收费的,虽然微软开源了部分TTS的功能,但是针对真人类似的富有情感的TTS模型并没有进行开源,本期介绍的ChatTTS是一个开源的真人转语音模型。

拍一张照,AI替你补出整个世界;扫一遍墙,机器人就能在里面自主导航。这不是科幻,是上周刚刚发布的Atlas。想象一个场景:你用手机随手拍了张家里客厅的照片,然后把它丢给一个AI。几秒后,它不仅"看懂"了照片里的空间——它还把整个房间的背面、侧面、俯视角,全部凭空生成出来了。连你沙发背后那一块从未入镜的墙,它都猜得八九不离十。再进一步:它把你的客厅变成了一个可以让机器人在里面自主行走的3D模拟环境。

SoulX-LiveAct突破长视频生成技术瓶颈,通过NeighborForcing策略解决时序稳定问题,采用ConvKVMemory机制实现恒定内存占用。仅需2张H100/H200 GPU即可实现20FPS实时推流,在口型同步、情感表达等指标达到SOTA水平。该技术将推动实时互动直播、虚拟助理等场景革新,相关论文和代码已开源。

在 Agentic 自动售货机测试台上,它以 4694.15 美元的净值和 4569 台的销量(5 次运行的平均值)占据主导地位,远远超过了 Claude Opus 4(2077.41 美元,1412 台)、人类(844.05 美元,344 台)和其他同类产品。这得益于整个堆栈的创新,包括新的基础设施和算法工作,这些工作将训练的计算效率提高了 6 倍,以及大规模的数据收集工作,XAI将可验证的训练

Hydra-MDP 提供了一个通用框架,展示了如何通过基于规则的规划器增强基于机器学习的规划。这种集成系统确保模型不仅模仿人类的驾驶行为,还遵守交通规则和安全标准,解决了传统模仿学习的局限性。Hydra-MDP 的数据驱动缩放定律证明了其稳健性和适应性。通过使用具有大量数据和 GPU 预训练基础模型,Hydra-MDP 展示了其可扩展性和持续改进的潜力。

Luma AI发布文生视频大模型Dream Machine模型,可以免费供大家使用,任何人只要到Luma AI的官方网站,就可体验Luma AI的文生视频魅力。








