logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

Debug pip: Could not build wheels for _ which use PEP 517 and cannot be installed directly - Easy So

Mac 安装gevent时报错Failed to build geventERROR: Could not build wheels for gevent which use PEP 517 and cannot be installed directly解决方法python -m pip install gevent

参加天池大数据竞赛是怎样一种体验?

参加过三次比赛,三次Top5,但是我想说:狗都不做好的部分工作人员的耐心和付出非常值得肯定,无论是技术还是非技术的支持我一直心怀感激一些赛题很新颖,例如工程赛或工程加算法赛不好的部分第一场AI earth比赛:季军是小号刷的由于大佬复现出了问题,所以我从B榜第5变成了第4,但是季军作为主办学校团队问题大了。比赛12点结束提交后还有很多队伍没有训练完,所以大家可能还有一次提分机会。16点南京某大学的

文章图片
#big data#大数据
数据竞赛:工业互联网算法大赛能源赛道风机轴承剩余寿命预测

背景做好比赛的关键大概是:“唯手熟尔”。熟练后,I guess取得成绩只是或早或晚的事情(sooner or later)。技能熟悉后,主要是要找到任务和数据的特殊之处并着手应对。这个题最特殊的大概是赛制,其实只有一周时间,而且是在测试集不可见、每天只提交一次的情况下,最后一天还要提供方案介绍、PPT、解说视频等材料。由于主办方不允许赛中和赛后开源代码,所以这里就介绍一下我之前的赛前准备。八月初还

#算法#能源#人工智能
动手学习RAG:rerank模型微调实践 bge-reranker-v2-m3

本文我们研究的是 bge-reranker-v2-m3模型。

#学习
大语言模型-中文chatGLM-LLAMA微调

中文instruct在chatGLM, LLAMA上的表现。

文章图片
#人工智能
大模型智能体实战指南

可以分为短期记忆与长期记忆,同时Agentic RAG也可以认为是记忆模块的一种,claude的skills,Manus的文件也都是为了增强智能体的记忆能力。然后我们的agent会负责执行这个工具,并把工具结果作为context继续输入给大模型,如果需要多次调用工具则进行反复调用,最终大模型输出正式的结论。最近流行的大模型智能体,以大模型为大脑,通过调用工具来完成复杂的任务。强化学习中的智能体 通

#机器学习
强化学习: PPO模型

Agent又被称为Actor,Actor对于特定的任务,有自己的一个策略π,策略π用一个神经网络表示,其参数为θ。从一个特定的状态state出发,一直到任务的结束,被称为一个完整的eposide,在每一步,我们都能获得一个奖励r,一个完整的任务所获得的最终奖励被称为R。模型的学习过程就是调整Actor的策略π,使得期望奖励最大化,于是有了策略梯度的方法。既然奖励的期望函数如上,只要使用梯度提升的方

#机器学习#人工智能
大语言模型-中文Langchain

使用chatGLM6b + langchain实现本地化知识库检索与智能答案生成。

文章图片
#语言模型#python#深度学习
    共 60 条
  • 1
  • 2
  • 3
  • 6
  • 请选择