
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
欢迎加入 CPF-Flutter 鸿蒙社区:https://atomgit.com/CPF-Flutter挑做鸿蒙适配,理由很实际:它只有三个 Dart 方法和一个回调,依赖里除了 Flutter SDK 什么都没有,代码量小到能一眼看完。这种库最适合用来把一整条适配流程走通——从查重、读上游、定 API,到真机跑起来。先说结论:适配本身不难,难的是。官方文档里推荐的替代方案,对 Flutter

欢迎加入 CPF-Flutter 鸿蒙社区:https://atomgit.com/CPF-Flutter挑做鸿蒙适配,理由很实际:它只有三个 Dart 方法和一个回调,依赖里除了 Flutter SDK 什么都没有,代码量小到能一眼看完。这种库最适合用来把一整条适配流程走通——从查重、读上游、定 API,到真机跑起来。先说结论:适配本身不难,难的是。官方文档里推荐的替代方案,对 Flutter

昇腾 CANN 通过全栈式优化能力与开放的工具链,为大模型部署、多模型协同、边缘计算等进阶场景提供了高效的技术支撑。本文的三个实战案例覆盖了从云端大模型推理到边缘设备实时分析的核心流程,展现了 CANN 在性能优化、跨场景适配、工程化落地等方面的优势。随着 AI 技术向更复杂、更边缘的场景渗透,CANN 将持续迭代核心能力,降低异构计算开发门槛,成为推动 AI 规模化落地的核心引擎。

本次实践从获取 API Key 到创建智能体并关联模型,共完成 6 个核心步骤 —— 流程的关键在于 “接口信息匹配” 与 “协议适配”:Kimi-K2 的 OpenAI 协议适配性,让 openJiuwen 无需额外开发即可快速接入;而严格匹配 ModelArts 的接口参数,则确保了模型调用的准确性。完成接入后,Kimi-K2 的长文本处理能力可支撑智能体实现项目提案分析、文档总结等复杂任务,

《专注时光盒:数字时代的极简守护》摘要 在信息过载的数字时代,专注力已成为稀缺资源。"专注时光盒"应运而生,这款基于OpenHarmony的极简工具摒弃复杂功能,回归专注本质。通过三大设计原则:零认知负担、无干扰承诺和情感化反馈,它能在多终端(手表/智慧屏/车机)场景中守护用户心流。仅79行核心代码实现的计时器,通过可视化进度环和微光涟漪反馈,创造无压力的专注空间。该设计体现&

const Emotion('宁静', Colors.blue.shade300, '🌊 平静如水', 'calm'),const Emotion('温暖', Colors.orange.shade400, '☀️ 被阳光拥抱', 'warm'),const Emotion('活力', Colors.green.shade400, '🌱 生命在生长', 'energetic'),

大模型推理中的Prefill和Decode阶段对硬件需求不同,hixl库通过单边通信技术实现高效KV Cache传输。Prefill阶段使用高算力NPU处理prompt,Decode阶段用高带宽NPU生成token,hixl通过RDMA硬件直通、HBM地址注册和内存窗口技术,实现零拷贝的单向数据传输,相比传统双边通信显著降低延迟。该方案特别适合PD分离场景中的大块低频数据传输,但不适用于需要全局同

昇腾NPU上运行LLaMA-7B模型时,原生PyTorch推理性能较低(仅4-5 token/s),主要因算子调度开销大(占15-20%)和HBM频繁读写。ATB(Ascend-Transformer-Boost)通过以下优化显著提升性能: 算子融合:将Transformer层打包为融合算子,减少调度开销; 内存优化:采用环形缓冲管理KV Cache,降低显存占用; 量化支持:提供W8A8和W4A

当我们把鸿蒙原生的 Web 进程隔离机制、JSBridge 的跨进程代理映射,以及 ArkTS 的 Actor 并发模型全部融合在一起时,我们实际上已经脱离了传统前端“画皮”的工作范畴,正式步入了系统架构设计的领域。这套混合架构与高并发引擎的组合,能够让你在一个应用里,既享受到 H5 强大的跨平台生态和热更新能力,又能借用底层 C++ 和多核 CPU 算力,解决那些 H5 永远无法逾越的性能瓶颈。

pypto工具允许开发者使用Python语法直接编写PTO虚拟指令集程序,绕过Ascend C直接编译到NPU执行。它提供了指令级控制能力,可以精细调度流水线、管理寄存器和L1缓存。通过Python API实现类似汇编的编程方式,支持手动双缓冲流水线优化,相比编译器自动调度可获得10-15%的性能提升。但需要注意指令延迟模拟与实际NPU执行的差异,以及Python侧内存生命周期管理问题。该工具还提








