
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
FlagEval发布两大AI模型评测榜单:1)安全与价值观榜单对18款主流模型进行3000题测试,ClaudeSonnet4以86.76%合格率居首,头部模型主观题表现优异(97%+),但客观题存在20-25%差距;2)11月角斗场排行榜引入多模型对战机制和深度推理指标,o4-mini、GPT4.1-mini等位列第一梯队。榜单旨在建立科学评估标准,推动AI安全与能力发展。

还在为云端大模型的隐私风险和高昂 Token 成本发愁?众智 FlagOS 联合腾讯云 HAI,正式将 Qwen3-4B-hygon-flagos 模型镜像上线!本文手把手教你在国产 AI 芯片上快速部署 FlagOS + OpenClaw,以小模型驱动智能体执行任务,并无缝接入 QQ 机器人 。带你零门槛体验本地 7×24 小时待命的“数字员工”,轻松实现“养虾”自由!

当下,"异构算力协同、大模型普惠落地"已成为全球开源开发者社区的核心热点,打破硬件生态隔离、让大模型在不同算力平台高效低成本运行,是无数开发者的核心诉求。FlagGems 作为 FlagOS 核心的高性能通用大模型算子库,基于 Triton 语言实现,针对 MiniMax M2.7 推理链路的核心算子进行了深度适配与优化,包括 MoE 专家调度、Attention 计算、RMSNorm 等关键计算

本文首先介绍 Engram 的核心思想,然后阐述基于 FlagOS 系统软件栈中的训练插件完成的 Engram 架构全链路复现。在此基础上,重点展示 FlagOS 针对 Engram 进行的三大工程优化。实验量化结果表明,FlagOS 对 Engram 的优化在保持额外负载为零的前提下,使吞吐最高提升近 150%。
纵观全天的 FlagOS 技术开发工作坊,一条清晰的脉络浮现出来:FlagOS 正在从"提供若干正确的单体组件",转向"用AI让这些组件在真实场景中协同运转"。全天高密度的理论拆解与手把手的真机实操交织,让这场工作坊不再是纸上谈兵。一方面,Triton-TLE、FlagTree CPU 扩展与 FlagIR 编译器基建,展示了打通多芯片孤岛、榨干硬件性能的硬核底力;

阿里巴巴开源270亿参数视觉语言模型Qwen3.8-27B,并通过众智FlagOS社区完成跨平台适配。该模型已在11款AI芯片(包括平头哥、英伟达、摩尔线程等)和ARM端侧平台完成部署验证,其中摩尔线程支持FP8精度,其余芯片支持BF16。FlagOS技术栈首次实现27B大模型在ARM平台的W4A8低比特量化部署,推理性能显著优于原生方案。模型具备26万token长文本处理能力,支持代码生成、智能

FlagOS社区同步完成智谱开源多模态MoEt模型GLM-5.3-Flash在9款芯片的Day0适配,当前模型镜像已发布魔搭和Hugging Face,开发者无需修改代码即可跨芯部署!

FlagOS 为主流推理框架打造了统一的多芯片插件,包括 vLLM-plugin-FL 和 SGLang-plugin-FL,基于 FlagOS 统一多芯片后端开发,在不改变原生接口与用户使用习惯的前提下,实现 Qwen3.8-Flash-Next 的多芯片推理部署。其他芯片的运行时版本、插件分支、FlagGems/FlagTree 提交以及是否需要 FlagCX,请以对应芯片的模型卡和 vLLM

视频生成推理框架 LightX2V 近日推出基于 FlagOS 的跨芯片插件 lightx2v-plugin-FL。该插件以独立 Python 包形式接入,不改主链路,即可为 LightX2V 获得跨芯片适配能力。目前已在平头哥 PPU-ZW810E 双卡上完成 DreamZero 视频与动作生成任务的完整链路验证。

联合国开发计划署非洲区域局将于9月1日在北京智源人工智能研究院举办“廷巴克图”中非AI合作研讨会。会议聚焦非洲初创企业在医疗、金融、农业等领域的AI应用需求,探讨中非在技术、算力、投资等方面的合作路径。五家非洲创新企业将展示本土化解决方案,中方将分享FlagOS开源技术等成果,旨在通过开放计算生态降低算力门槛,推动AI普惠发展。活动以闭门交流形式促进务实对接,助力中非数字合作从理念走向落地。









