
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
WeKnora是腾讯开源的文档理解与语义检索框架,支持多模态文档处理、智能问答和RAG机制。其特点包括开箱即用的WebUI、多模态解析能力、灵活配置和跨平台访问。应用场景涵盖企业知识管理、科研分析、技术支持等领域。部署需安装Docker和Git,通过可视化界面可配置模型参数。WeKnora还支持通过MCP服务器远程访问,实现便捷的文档问答服务。

完整14个项目及项目详细介绍见文章下方。完整14个项目及项目详细介绍见文章下方。
本章节主要讲解DPO强化学习微调验证的必要性与方法。确保微调效果具有关键作用,证明微调有效性、发现具体改进点、质量控制及业务价值评估。验证面临技术实现难度、评估标准主观性和资源消耗高等挑战。
EvalScope破解大模型评估难题 阿里云推出的EvalScope评估框架有效解决了大模型评估中的"黑盒"问题。该工具提供标准化测试(MMLU、C-Eval等)和自定义数据集支持,覆盖认知能力、安全合规、多模态等全方位评估维度。通过OpenCompass等后端实现自动化评估,支持微调效果验证、方案对比和持续监控,将主观"感觉"转化为客观数据。安装灵活,可根
快速进行私有模型微调,主要解决当前大模型微调面临的技术门槛高、资源需求大和缺乏标准化流程三大痛点。项目提出使用Unsloth框架实现低成本高效微调,通过消费级显卡(如RTX 4090)完成专业设备的工作,实现10倍成本降低和3-5倍训练加速。文章详细说明了环境搭建步骤,包括conda环境创建、JupyterLab安装、Unsloth框架部署等,并提供了模型测试和私有数据集创建的代码示例。该项目特点

大语言模型训练分为预训练、监督微调(SFT)和强化学习(RL)三阶段。SFT虽能让模型掌握基本技能,但存在三大局限:只能模仿无法超越训练数据、标注成本高覆盖面窄、难以定义"优质回答"的软标准。RL通过"试错-反馈"机制,让模型探索更优解,将标注任务从创作转为评判,效率提升10倍,并能学习人类难以言传的偏好。然而大模型RL面临模型体积大、训练速度慢、显存需求高

本文对比了AI视觉领域的两种主流技术:YOLO系列和视觉大模型(VLM)。YOLO作为快速检测模型,在速度和效率上表现突出,但局限于训练数据;新版YOLO-World已拓展到开放词汇识别。VLM则具备更强的语义理解能力,但计算成本高、响应慢。文章分析了它们各自的应用场景:YOLO适用于实时性要求高的场景如自动驾驶,VLM则更适合需要深度理解的智能交互任务。最后介绍了相关AI学习课程,帮助读者掌握这

2025年迎来Agent(智能体)爆发元年,大模型技术从聊天工具升级为能自主执行任务的产业级生产力。本文提供从入门到落地的实践指南,重点解析企业最需求的四大AI应用场景:对话增强(Agentic RAG)、多模态内容生成、AI编程/数据分析及垂直行业解决方案。技术人需掌握模型选型(如DeepSeek-V3.2)、知识增强(RAG)、工具调用(Function Calling)和流程编排(LangG

本文介绍了基于Agent-Lightning框架的SQL-Agent强化学习实战方法。项目采用运行与训练分离的架构设计,通过LangGraph实现SQL Agent的运行逻辑,记录自然语言到SQL转换的完整轨迹。训练模块利用veRL框架和GRPO算法,根据执行结果自动优化模型策略,形成"执行-反馈-优化"的闭环训练流程。实验在H800显卡上进行,通过Agent-Lightnin

总参 1.6T,激活 49B:总参 284B,激活 13B两款都吃 100 万 token 上下文Instruct 版走 FP4 + FP8 混合精度,base 全 FP8全部 MoE 架构数字猛归猛。但 1.6T 不是这次的看点——上半年 1T 级的开源 MoE 已经不止一家。








