logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

大模型实习复盘:GPT老师带你一个个接口硬啃

3.后来读研一年多,潜修内功,学了vLLM,peft之类的训练框架,做了几个横向课题,对简单业务熟练了。选择了小厂继续做rag,不过这边有agent开发内容,学会了langchain那些框架,有一说一感觉没啥用,自己也能写,纯应用层包装,门槛特低。总结:互联网中厂大厂,尤其是给你权限给你机器玩的,去,提升极大。小公司or普通研究院,非常一般。海面了好几家公司,靠以前的课题项目和pku一个研究院切合

#人工智能#语言模型
大模型实习复盘:导师给8卡4090如何高效利用

3.后来读研一年多,潜修内功,学了vLLM,peft之类的训练框架,做了几个横向课题,对简单业务熟练了。选择了小厂继续做rag,不过这边有agent开发内容,学会了langchain那些框架,有一说一感觉没啥用,自己也能写,纯应用层包装,门槛特低。总结:互联网中厂大厂,尤其是给你权限给你机器玩的,去,提升极大。小公司or普通研究院,非常一般。海面了好几家公司,靠以前的课题项目和pku一个研究院切合

#人工智能#语言模型
大模型实习技术栈:分布式训练加推理框架学习笔记

体验是技术含量很高进步很大,虽然业务核心代码没啥注释,但用的都是比较先进的工程框架,靠着GPT老师一个个接口学,硬啃学会了分布式训练框架、推理框架,各种类型的微调……选择了小厂继续做rag,不过这边有agent开发内容,学会了langchain那些框架,有一说一感觉没啥用,自己也能写,纯应用层包装,门槛特低。小公司or普通研究院,非常一般。海面了好几家公司,靠以前的课题项目和pku一个研究院切合,

#人工智能#语言模型
大模型实习岗位细分:你适合哪个方向

现在95%的大模型实习岗位,都不是让你去从头“创造”一个GPT-5,而是让你基于现有的模型,去做各种“下游”工作。大家想象中的大模型实习,可能是这样的:一排排A100/H100在你面前闪烁,你和团队大佬一起,对着满屏的代码和公式,高喊一声“开始训练!实际情况更可能是这样的:你的导师(mentor)丢给你一个开源模型(比如Llama 3, Qwen, ChatGLM),然后让你去解决一个具体的业务问

#人工智能
大模型实习备战路线图:从入门到入职

现在95%的大模型实习岗位,都不是让你去从头“创造”一个GPT-5,而是让你基于现有的模型,去做各种“下游”工作。大家想象中的大模型实习,可能是这样的:一排排A100/H100在你面前闪烁,你和团队大佬一起,对着满屏的代码和公式,高喊一声“开始训练!实际情况更可能是这样的:你的导师(mentor)丢给你一个开源模型(比如Llama 3, Qwen, ChatGLM),然后让你去解决一个具体的业务问

#人工智能
大模型在数据开发场景的落地实践

所以最后我们退而求其次,还是做辅助吧,就是你一个需求来了,先帮你设计个大概,或者你自己描述清楚点,一步步做引导式的进行开发,就像现在的cursor,不过这里做了rag检索,就是用把2️⃣里面的表和描述都放进去了。首先这个一开始想的是给运营和老板做的,因为他们不会写代码,但是就是会有各种奇奇怪怪的查数需求,之前都是提需求给数据研发,所以想说能不能用大模型做这事,这个功能我觉得做的不是很好,虽然老板和

#人工智能#语言模型
大模型如何提效数据开发?大厂实战经验

所以最后我们退而求其次,还是做辅助吧,就是你一个需求来了,先帮你设计个大概,或者你自己描述清楚点,一步步做引导式的进行开发,就像现在的cursor,不过这里做了rag检索,就是用把2️⃣里面的表和描述都放进去了。首先这个一开始想的是给运营和老板做的,因为他们不会写代码,但是就是会有各种奇奇怪怪的查数需求,之前都是提需求给数据研发,所以想说能不能用大模型做这事,这个功能我觉得做的不是很好,虽然老板和

#人工智能#语言模型
大模型实习上岸攻略:导师想要的技能

现在95%的大模型实习岗位,都不是让你去从头“创造”一个GPT-5,而是让你基于现有的模型,去做各种“下游”工作。大家想象中的大模型实习,可能是这样的:一排排A100/H100在你面前闪烁,你和团队大佬一起,对着满屏的代码和公式,高喊一声“开始训练!实际情况更可能是这样的:你的导师(mentor)丢给你一个开源模型(比如Llama 3, Qwen, ChatGLM),然后让你去解决一个具体的业务问

#人工智能
大模型实习内推:这些技能必须具备

现在95%的大模型实习岗位,都不是让你去从头“创造”一个GPT-5,而是让你基于现有的模型,去做各种“下游”工作。大家想象中的大模型实习,可能是这样的:一排排A100/H100在你面前闪烁,你和团队大佬一起,对着满屏的代码和公式,高喊一声“开始训练!实际情况更可能是这样的:你的导师(mentor)丢给你一个开源模型(比如Llama 3, Qwen, ChatGLM),然后让你去解决一个具体的业务问

#人工智能
大模型实习上岸:某互联网中厂核心AI业务面经

3.后来读研一年多,潜修内功,学了vLLM,peft之类的训练框架,做了几个横向课题,对简单业务熟练了。选择了小厂继续做rag,不过这边有agent开发内容,学会了langchain那些框架,有一说一感觉没啥用,自己也能写,纯应用层包装,门槛特低。总结:互联网中厂大厂,尤其是给你权限给你机器玩的,去,提升极大。小公司or普通研究院,非常一般。海面了好几家公司,靠以前的课题项目和pku一个研究院切合

#人工智能#语言模型
    共 27 条
  • 1
  • 2
  • 3
  • 请选择