logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

一篇看懂大语言模型的关键技术

本文介绍了大语言模型的关键技术,包括预训练、适配微调、提示学习和知识增强。预训练通过统一序列建模和高效架构奠定基础;适配微调采用参数高效方法(如Prefix-Tuning、LoRA等)优化特定任务表现;提示学习通过设计提示模板引导模型执行任务;知识增强则通过知识图谱和专业语料提升模型知识储备。相关学习资源可在Github和Gitee获取。

文章图片
#语言模型#人工智能#自然语言处理
解锁Prompt秘籍:框架、技巧与指标全解析

通过对 Prompt 的深入探讨,我们了解到它作为与大模型交互的关键,在各个领域都发挥着重要作用。掌握万能框架,能让我们迅速构建出有条理、有针对性的 Prompt;运用优化技巧,则能不断打磨 Prompt,提升模型输出的质量;而熟悉常用指标,帮助我们科学地评估和改进 Prompt,让模型更好地为我们服务。随着人工智能技术的不断发展,Prompt 工程也在持续演进。未来,我们有望看到更多智能化的 P

文章图片
#人工智能#语言模型#科技
大模型入门科普:定义、应用与训练方法

本文介绍了大模型的基本概念、应用场景和训练方法。大模型指具有海量参数的深度学习模型,能够处理复杂的自然语言、图像识别等任务。其应用广泛,包括文本生成、机器翻译、智能客服、图像识别、医疗诊断等领域。训练大模型需要经过数据收集预处理、选择合适的模型架构(如Transformer)、采用反向传播算法和优化策略(如数据增强、正则化)等步骤,通常先进行大规模预训练再针对特定任务微调。随着技术进步,大模型正推

文章图片
#人工智能#自然语言处理#语言模型 +1
解锁大模型微调:定制专属AI的神奇密码

泡泡搜索【码上有模力】留【大模型】在当今数字化浪潮中,大模型作为人工智能领域的璀璨明星,正以前所未有的态势重塑着各个行业。从自然语言处理领域的文本生成、机器翻译,到医疗领域的辅助诊断、药物研发,再到金融领域的风险评估、投资决策,大模型凭借其强大的学习能力和泛化能力,宛如一位全能的智者,为我们解决着各种各样复杂的问题。想象一下,当你在撰写一篇新闻报道时,大模型能够根据你提供的关键词和主题,瞬间生成一

文章图片
#人工智能#语言模型
大模型推理:解锁人工智能的“思考”密码

在日常生活中,我们经常会进行推理。比如,看到天空乌云密布,就推测可能要下雨;听到邻居家的狗一直叫,会猜测是不是有陌生人经过。这种从已知信息得出结论的思维过程,就是推理。对于大模型来说,推理同样是从已有的数据和知识中得出结论的过程。假设你问大模型:“如果一列火车以每小时 60 英里的速度行驶 3 小时,它行驶的距离是多少?

文章图片
#人工智能#语言模型
一文读懂LLM:从结构到训练,全面剖析大语言模型的核心奥秘

大型语言模型(LLM)凭借Transformer架构和自注意力机制,成为自然语言处理领域的核心技术。其结构分为编码器和解码器,分别负责信息理解和文本生成。模型推理过程包含Prefill(输入处理)和Decode(文本生成)两个阶段,通过贪婪解码、随机采样等策略控制输出质量和多样性。温度参数和核采样等技术帮助平衡生成文本的准确性与创造性。从智能客服到内容创作,LLM正在深刻改变人机交互方式,其强大的

文章图片
#人工智能#语言模型#神经网络 +3
从Transformer到扩散模型:解锁大模型背后的技术魔法

本文深入解析了Transformer和扩散模型这两项推动AI大模型发展的关键技术。Transformer通过自注意力机制和多头注意力,突破了传统RNN/CNN处理序列数据的局限,成为NLP领域基石,并衍生出GPT等强大模型。扩散模型则创新性地采用反向去噪过程生成图像,相比GAN在质量和多样性上表现更优。文章详细剖析了Transformer的编码器-解码器架构、残差连接等核心组件,以及扩散模型的工作

文章图片
#科技#人工智能#深度学习 +1
超详细大模型盘点!谁才是潜力股?

大模型技术正深刻改变各行业格局。国内外知名大模型如GPT-4、Claude-3、文心一言等在语言理解、代码生成等领域表现优异,但也存在成本高、数据隐私等问题。国内行业应用已取得显著成效:教育领域实现个性化学习,医疗行业提升诊疗效率,金融业优化风控服务,制造业加速智能转型。典型案例包括深圳福田区的政务大模型应用和上海汽轮机厂的智能设计平台,均实现效率大幅提升。随着技术创新,大模型将持续赋能各行业智能

文章图片
#人工智能#语言模型#深度学习
一文搞懂Transformer:大模型背后的“超级引擎”

Transformer:大模型背后的革命性架构 Transformer架构自2017年提出以来,彻底改变了自然语言处理领域。其核心创新在于完全摒弃了传统的循环结构,转而采用自注意力机制和多头注意力机制,实现了三大突破性优势: 并行计算能力:打破RNN的顺序处理限制,大幅提升计算效率 长距离依赖处理:通过自注意力机制有效捕捉任意位置的关系 任务普适性:不仅适用于翻译等NLP任务,还广泛应用于图像、语

文章图片
#transformer#深度学习#人工智能
一文搞懂!蒸馏、微调、RAG,AI大模型的进阶密码

本文深入解析了AI大模型中的蒸馏、微调和RAG三大核心技术。蒸馏通过知识迁移将大模型能力压缩至小模型,实现高效部署;微调基于预训练模型,使用特定领域数据进行二次训练,提升专业任务表现;RAG则结合检索与生成技术,利用外部知识库增强模型回答的准确性和时效性。文章通过生动类比和原理分析,清晰比较了三者的技术特点、应用场景及优劣势:蒸馏适用于资源受限环境,微调专注于领域专业化,RAG则解决知识更新问题。

文章图片
#人工智能#深度学习#语言模型
    共 46 条
  • 1
  • 2
  • 3
  • 4
  • 5
  • 请选择