logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

如何实现一个百万亿规模的时序数据库,百度智能云 BTS 架构解析和实践分享

BTS 可用于丰富的场景,比如横向业务场景(分布式存储、结构化、聚合、高性能检索)、纵向行业场景(互联网、广告、feed、物联网、大数据、时序)以及一体化解决方案(大数据分析生态,监控)等,支撑业务创新。BTS 目前支持超万亿的日均访问量,场景上覆盖了宽表、时序、大数据的处理和分析场景,覆盖了物联网、AI、feed 流、广告、健康、搜索、web 应用、自动驾驶等诸多方向。BTS 具备了完善的高可用

文章图片
#时序数据库#百度
像搜索一样简单,百度网络运维的 AI 智能体设计和实践

如果我们把时延和拓扑数据交给 LLM 进行分析,它会结合拓扑对时延数据进行分析,并且给出最终的结论:当前每一组的时延是否正常,时延数据是否符合实际数据、如果有异常,是哪一组或者哪些组有异常,该怎么检查,LLM 会分析得明明白白的。

文章图片
昆仑芯超节点创新设计:1U 4 卡高密算力,无缝适配各类机房环境

在百度天池 AI 高密液冷整机柜的支撑下,昆仑芯超节点支持 1U 4 卡的超高密度算力交付形式,单节点一个人即可轻松维护。计算节点的核心芯片的温度可以降低 20℃ 以上,为 XPU 提供稳定的运行环境。能够适应各种机房的供电环境,并支持在风冷机房部署交付。

文章图片
入选 SOSP‘25:百度智能云对象存储的分布式层级 Namespace 破解业界难题,彻底扫清 AI 时代大数据上云障碍

正因为如此,业界一直缺乏一种既能发挥对象存储成本与扩展性优势,同时又能媲美 HDFS 性能的真正可扩展、高性能的层级命名空间解决方案,导致「对象存储成为数据湖存储底座」的愿景,在实际落地中屡屡受阻。Mantle 创新性地将传统文件系统的强大语义优势,与新型对象存储的低成本、可扩展、云原生易运维特性完美融合,实现了革命性的突破,为 EB 级别的新一代数据湖打开了前所未有的想象空间。此次入选 SOSP

#人工智能#云计算
全球首个超声多模态大模型!百度百舸支撑海豚智能实现高效训练与稳定服务

在百度百舸 · AI 计算平台的全方位支持下,Dolphin V1.0 成功上线。Dolphin V1.0 在胎儿标准切面识别上的准确率超过 90%,在乳腺病灶分型任务中准确率达到 86%。与上一代仅能执行单任务的专用模型相比,Dolphin 实现了“一模多能”的通用能力,模型复用效率显著提升。未来,海豚智能将不断深化与百度智能云的合作,基于百舸平台全周期的 AI 工程支持,持续训练、提升模型能力

#百度
百度亮相 SREcon25:搜索稳定背后的秘密,微服务雪崩故障防范

历经体系化治理,百度搜索已实现大规模微服务体系的稳定性跃升。通过微观机制改造、预案建设并经生产环境验证,百度在过去多个季度中消除了系统雪崩事件。本次 SREcon25 的主题分享,不仅展现了团队在微服务可靠性与韧性架构领域的系统化研究成果,也向国际同行展示了百度工程团队在大规模系统稳定性治理上的深厚积累与方法论创新。未来,运维部与搜索架构部将继续深耕自治运维、稳定性建模与智能化自愈机制的研究,携手

#微服务#dubbo#架构
百度百舸面向百度天池超节点的大模型推理引擎优化,持续降低昆仑芯 XPU 的 token 成本

超节点作为一种创新的硬件架构,通过构建大规模全互联的 Scale-up 网络,有效突破了传统 8 卡节点在通信上的「互联墙」瓶颈,为上层业务提供了极致的互联带宽与统一显存池化能力,从而实现大模型推理服务性能的跨越式提升。结合新硬件架构的特性,AI Infra 团队可以基于对上层模型算法特性的深度理解,进一步做 AI 工程上的软件优化,充分释放硬件潜能,在吞吐量、首 Token 延迟(TTFT)、每

128 卡 4 天时间!百度百舸助力 LLaVA-OneVision-1.5 刷新多模态大模型训练效率纪录

在过去,训练一款高性能视觉大模型,往往需要承担高昂成本与复杂工程压力。9 月底,灵感实验室与 LMMs-Lab 联合推出的 LLaVA-OneVision-1.5 彻底改写了这一现状。这款具备视觉理解、图文对话能力的 8B 规模多模态模型,仅用 128 张 A800 GPU 4 天时间便完成预训练,且在公开基准测试中性能媲美顶级大模型,印证了「非堆量式」性能提升的技术价值。

#人工智能
百度智能云 X 十字路口 | 对谈王雁鹏:亲述从大数据时代到 3 万卡集群的中国算力演进史

在 AI 的下半场,算法的创新固然重要,但算力好像正在成为终极的变量,AI 的军备竞赛,已经从代码和模型,延伸到了芯片、电力和数据中心这些更底层的物理世界。近期,百度智能云与十字路口推出联合播客,在节目上,百度智能云 AI 计算首席科学家王雁鹏与十字路口主播 Koji 杨远骋展开一场深度对谈,亲述从大数据时代开始的中国互联网基础设施演进。本期播客对谈原文约 22000 字,本文经过删减整理后约 9

#云计算
2 天速通小米 MiMo Flash V2,vLLM-Kunlun Plugin 助力昆仑芯高效适配最新大模型

从适配架构新特性实现模型跑通,到深度优化完成性能精度双提升,仅用 2 天时间便让 MiMo Flash V2 在 vLLM 环境中于昆仑芯 P800 稳定高效运行,vLLM-Kunlun Plugin 用实际成果证明了国产芯片与开源生态协同适配的高效性。作为全面开源的插件项目,vLLM-Kunlun Plugin 基于 vLLM 社区 RFC#11162硬件插件标准开发,实现了 vLLM 社区版与

    共 127 条
  • 1
  • 2
  • 3
  • 13
  • 请选择