
简介
该用户还未填写简介
擅长的技术栈
未填写擅长的技术栈
可提供的服务
暂无可提供的服务
【SkillRL】强化学习详解
本文档梳理启动后,代码从入口到最终策略更新的完整执行流程,涵盖动作模拟、环境交互、奖励计算、技能注入和动态更新等关键环节。
【目标检测】利用强化学习提高目标检测效果
里哦用机器学习提高目标检测效果,相较yolov8,效果提升7%

利用chatglm进行问答对生成 自动问答对生成
以下提示词,以用来从一些文本中生成问题和对应的答案,能够达到接近人类70%的水平。
【MinerU】 Docker Compose 使用
(如不能同时运行 api + openai-server)。如果需要多种服务,只能运行其中一个,或使用 Router 聚合远程 API。目前 compose.yaml 不直接支持昇腾 NPU 的设备透传配置,建议使用。Docker Compose 需要 MinerU 的 Docker 镜像,需先构建。:Docker 部署仅支持 Linux 和 Windows WSL2,使用 NPU Dockerf
【阿里DeepResearch】SailorFog-通过高质量SFT训练具备推理能力的Web Agent
通过高质量sft与rl,提升模型推理能力

【AI工具排行榜】AI工具推荐 帮你找到最合适的AI工具
AI工具推荐,AI排行榜,帮助你找到更合适的AI工具

【RAG过滤排序技巧】HiFi-RAG 超越Gemini NeurIPS25冠军
层次化过滤+大模型排序,Rag效果超过Gemini,实现性能与准确率的平衡。

【Claude Code】最佳实践 翻译
Claude Code使用技巧
【智能体工具】Claude工具设计原则
Claude的工具设计原则,提高agent调用效果。
【逐句RAG】SentGraph逐句分析 提升RAG系统准确率
逐句进行RAG 降低召回内容冗余度 提升RAG系统效果








