logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

weknora —— 基于大模型的文档理解检索框架

WeKnora是腾讯开源的文档理解与语义检索框架,支持多模态文档处理、智能问答和RAG机制。其特点包括开箱即用的WebUI、多模态解析能力、灵活配置和跨平台访问。应用场景涵盖企业知识管理、科研分析、技术支持等领域。部署需安装Docker和Git,通过可视化界面可配置模型参数。WeKnora还支持通过MCP服务器远程访问,实现便捷的文档问答服务。

文章图片
#人工智能
14项热门大模型落地项目(工业级实操案例)

完整14个项目及项目详细介绍见文章下方。完整14个项目及项目详细介绍见文章下方。

#人工智能
大模型DPO强化学习效果检验

本章节主要讲解DPO强化学习微调验证的必要性与方法。确保微调效果具有关键作用,证明微调有效性、发现具体改进点、质量控制及业务价值评估。验证面临技术实现难度、评估标准主观性和资源消耗高等挑战。

#人工智能
大模型高效微调evalscope实战

EvalScope破解大模型评估难题 阿里云推出的EvalScope评估框架有效解决了大模型评估中的"黑盒"问题。该工具提供标准化测试(MMLU、C-Eval等)和自定义数据集支持,覆盖认知能力、安全合规、多模态等全方位评估维度。通过OpenCompass等后端实现自动化评估,支持微调效果验证、方案对比和持续监控,将主观"感觉"转化为客观数据。安装灵活,可根

#人工智能
大模型高效微调unsloth实战

快速进行私有模型微调,主要解决当前大模型微调面临的技术门槛高、资源需求大和缺乏标准化流程三大痛点。项目提出使用Unsloth框架实现低成本高效微调,通过消费级显卡(如RTX 4090)完成专业设备的工作,实现10倍成本降低和3-5倍训练加速。文章详细说明了环境搭建步骤,包括conda环境创建、JupyterLab安装、Unsloth框架部署等,并提供了模型测试和私有数据集创建的代码示例。该项目特点

文章图片
大模型训练的“最后一公里”:为什么强化学习(RL)不可或缺?

大语言模型训练分为预训练、监督微调(SFT)和强化学习(RL)三阶段。SFT虽能让模型掌握基本技能,但存在三大局限:只能模仿无法超越训练数据、标注成本高覆盖面窄、难以定义"优质回答"的软标准。RL通过"试错-反馈"机制,让模型探索更优解,将标注任务从创作转为评判,效率提升10倍,并能学习人类难以言传的偏好。然而大模型RL面临模型体积大、训练速度慢、显存需求高

文章图片
AI 也是脸盲?一文看懂 YOLO 和大模型怎么看世界

本文对比了AI视觉领域的两种主流技术:YOLO系列和视觉大模型(VLM)。YOLO作为快速检测模型,在速度和效率上表现突出,但局限于训练数据;新版YOLO-World已拓展到开放词汇识别。VLM则具备更强的语义理解能力,但计算成本高、响应慢。文章分析了它们各自的应用场景:YOLO适用于实时性要求高的场景如自动驾驶,VLM则更适合需要深度理解的智能交互任务。最后介绍了相关AI学习课程,帮助读者掌握这

文章图片
#计算机视觉
大模型入门到工业级落地:15 个工业项目案例助力50W年薪

2025年迎来Agent(智能体)爆发元年,大模型技术从聊天工具升级为能自主执行任务的产业级生产力。本文提供从入门到落地的实践指南,重点解析企业最需求的四大AI应用场景:对话增强(Agentic RAG)、多模态内容生成、AI编程/数据分析及垂直行业解决方案。技术人需掌握模型选型(如DeepSeek-V3.2)、知识增强(RAG)、工具调用(Function Calling)和流程编排(LangG

文章图片
Agent RL 智能体强化学习实战(附源码)

本文介绍了基于Agent-Lightning框架的SQL-Agent强化学习实战方法。项目采用运行与训练分离的架构设计,通过LangGraph实现SQL Agent的运行逻辑,记录自然语言到SQL转换的完整轨迹。训练模块利用veRL框架和GRPO算法,根据执行结果自动优化模型策略,形成"执行-反馈-优化"的闭环训练流程。实验在H800显卡上进行,通过Agent-Lightnin

文章图片
V4 来了!DeepSeek双模型发布

总参 1.6T,激活 49B:总参 284B,激活 13B两款都吃 100 万 token 上下文Instruct 版走 FP4 + FP8 混合精度,base 全 FP8全部 MoE 架构数字猛归猛。但 1.6T 不是这次的看点——上半年 1T 级的开源 MoE 已经不止一家。

文章图片
#人工智能#自然语言处理
    共 186 条
  • 1
  • 2
  • 3
  • 19
  • 请选择