logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

保证git直线提交(rebase)而非创建分支(merge)

这样就不会产生 merge commit,提交历史会保持直线。git commit -m "你的提交信息"# 3. 在push前先更新(关键步骤)

#git
快速完成一个基于知识图谱的智能问答系统

请注意,这个过程可能需要一定的技术基础和知识储备,包括自然语言处理、知识图谱、数据库查询等方面的知识。同时,也需要一定的时间和资源投入来完成整个系统的开发和优化。

#知识图谱
使用已有的文档快速抽取三元组并构建知识图谱

请注意,这个过程可能需要一些自然语言处理、机器学习和数据库管理的技术知识。同时,为了获得高质量的知识图谱,可能需要进行大量的数据清洗和模型调优工作。

#知识图谱
大模型学习day3

预训练:海量无标注数据,模型自学通识打底。微调:少量专业标注数据,定向训练专属场景能力。Prompt:不改模型,靠文字指令临时控制输出。三者顺序:先预训练 → 再微调 → 日常用 Prompt 调用。零样本不给例子直接做;少样本给示例让模型模仿。

#学习
大模型学习day2

所有现代大模型底层都是。Transformer 核心是自注意力机制,擅长理解上下文。参数 = 模型的记忆和推理能力,参数越强越聪明。参数不是越大越好,要兼顾速度、成本、场景。上下文窗口:模型一次能处理和记住的文本长度。

大模型学习day5

大模型三种使用形态:在线 API、本地私有化部署、SaaS 平台。对话分:一次性单轮问答、带历史记录的多轮对话。偏低写代码,偏高搞创作。幻觉:大模型编造虚假信息、一本正经胡说八道。私密业务数据优先本地开源部署,不往外传。

#学习
大模型学习day4

闭源:只能调 API,不能本地部署、不能私自微调;开源:可下权重、本地部署、可二次微调;前端快速开发优先用闭源 API,私有化用开源;7B 小模型个人电脑就能跑,写前端代码完全够用;大模型对接本质就是调 HTTP 接口,和前端调后端接口逻辑一样。

大模型学习 day1

公开模型权重,可免费下载,能在个人电脑、服务器本地部署、自己二次微调。常见:Qwen 通义千问开源版、DeepSeek、Llama、GLM。简单理解:用海量互联网文本、代码、书籍语料,训练出的超大参数规模 AI 模型,具备语言理解、内容生成、逻辑推理、代码编写四大能力。用全网海量通用数据,让模型自学人类语言常识、语法逻辑、知识体系、代码规范。,就能控制大模型的输出内容、格式、风格。前端日常写代码、

大模型学习day7

不是改模型内部的底层参数,也不是重新生成模型用专属行业数据 / 个人风格数据,给模型做专项训练作用:让模型 f适配你的业务风格、固定回答套路区别:Prompt 是临时指令,微调是永久适配风格。

#学习
大模型学习day6

大模型一次能装下、能记住的最大文字总量。上下文窗口越大:能读长文档、记很多聊天记录上下文窗口越小:聊几句就忘、不能处理长文章常见规格:4K、8K、32K、128K(K 代表千 token)单轮无记忆,多轮带历史上下文。上下文窗口:模型能容纳的最大 token 容量。输入、输出 Token 都要计费。流式输出逐字展示,一次性输出整段返回。Prompt 就是给大模型的指令,写得好答案质量翻倍。

#学习
    共 77 条
  • 1
  • 2
  • 3
  • 8
  • 请选择