logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

资深软件工程师AI转型之路 | 原理篇03:数据工程一——高质量大模型训练文本语料准备

数据工程是大模型训练的核心地基,数据决定模型上限。本文从零带你完成大模型训练第一步:无版权、可商用、可教学的中英文训练语料获取与合规治理。包含 6 大类语料深度对比、个人 / 企业项目选型策略、一键可运行代码,全程 CPU 环境、无版权风险,配套 GitHub 工程化目录,适合新手入门与工程实践。

#人工智能#语言模型
资深软件工程师AI转型之路 | 前言--人工智能发展简史:从图灵测试到GPT-5,穿越三起两落的70年

摘要:本文梳理了人工智能从1950年代至今的发展历程。1956年达特茅斯会议首次提出AI概念,早期经历了感知机发明和工业应用尝试,但因技术瓶颈遭遇两次"寒冬"。1980年代专家系统兴起,1997年深蓝战胜国际象棋冠军。2006年CUDA技术为AI算力奠定基础,2012年AlexNet标志着深度学习时代开启。2017年Transformer架构革命性突破,2018年BERT确立预

#transformer
资深软件工程师AI转型之路 | 前言--人工智能发展简史:从图灵测试到GPT-5,穿越三起两落的70年

摘要:本文梳理了人工智能从1950年代至今的发展历程。1956年达特茅斯会议首次提出AI概念,早期经历了感知机发明和工业应用尝试,但因技术瓶颈遭遇两次"寒冬"。1980年代专家系统兴起,1997年深蓝战胜国际象棋冠军。2006年CUDA技术为AI算力奠定基础,2012年AlexNet标志着深度学习时代开启。2017年Transformer架构革命性突破,2018年BERT确立预

#transformer
资深软件工程师AI转型之路 | 原理篇--AI Agent实战:基于ReAct与FunctionCalling构建本地编程助手

本文通过一个从零构建的本地编程助手Agent项目,详解FunctionCalling如何与ReAct(推理-行动)模式协同工作,实现大模型对文件系统的增删改查操作。包含完整的Python代码解读、工作流程图及核心概念剖析,助你彻底掌握Agent的底层执行逻辑

#编程助手
资深软件工程师AI转型之路 | 原理篇03:数据工程一——高质量大模型训练文本语料准备

数据工程是大模型训练的核心地基,数据决定模型上限。本文从零带你完成大模型训练第一步:无版权、可商用、可教学的中英文训练语料获取与合规治理。包含 6 大类语料深度对比、个人 / 企业项目选型策略、一键可运行代码,全程 CPU 环境、无版权风险,配套 GitHub 工程化目录,适合新手入门与工程实践。

#人工智能#语言模型
资深软件工程师AI转型之路 | 原理篇01--从零手搓大模型:CPU 训练全流程与底层原理解释

本文系统梳理了从零构建大语言模型的全流程技术方案。在数据工程方面,详细介绍了语料清洗、BPE分词和词表生成的关键步骤;在模型架构部分,深入解析了Transformer的核心组件,包括词嵌入、位置编码、多头注意力机制等;最后阐述了模型训练与推理流程,涵盖损失计算、参数优化和部署方案。文章为纯CPU环境下的大模型轻量化实践提供了完整的技术参考路径,覆盖从数据处理到模型落地的全链路实现逻辑。

#人工智能#语言模型#transformer
资深软件工程师AI转型之路 | 原理篇--AI Agent实战:基于ReAct与FunctionCalling构建本地编程助手

本文通过一个从零构建的本地编程助手Agent项目,详解FunctionCalling如何与ReAct(推理-行动)模式协同工作,实现大模型对文件系统的增删改查操作。包含完整的Python代码解读、工作流程图及核心概念剖析,助你彻底掌握Agent的底层执行逻辑

#编程助手
资深软件工程师AI转型之路 | 前言--人工智能发展简史:从图灵测试到GPT-5,穿越三起两落的70年

摘要:本文梳理了人工智能从1950年代至今的发展历程。1956年达特茅斯会议首次提出AI概念,早期经历了感知机发明和工业应用尝试,但因技术瓶颈遭遇两次"寒冬"。1980年代专家系统兴起,1997年深蓝战胜国际象棋冠军。2006年CUDA技术为AI算力奠定基础,2012年AlexNet标志着深度学习时代开启。2017年Transformer架构革命性突破,2018年BERT确立预

#transformer
到底了