logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

FRP 内网穿透搭建(无域名)

frp是一种快速反向代理,可帮助您将NAT或防火墙后面的本地服务器暴露到Internet。到目前为止,它支持TCP和UDP,以及HTTP和HTTPS协议,其中请求可以通过域名转发到内部服务。

#macos
drools RETE算法

rete可以被分为两部分:规则编译和运行执行。规则编译是指根据规则集生成推理网络的过程,运行时执行指将数据送入推理网络进行筛选的过程。基本概念Rete算法的初衷是:利用规则之间各个域的公用部分减少规则存储,同时保存匹配过程的临时结果以加快匹配速度。为了达到这种效果,算法将规则拆分,其中每个条件单元作为基本单位(节点)连接成一个数据辨别网络,然后将事实(facts)经过网络筛选并传播,最终所...

大数据技术栈概貌

大数据技术栈概貌Hadoop生态

#大数据#hadoop
什么是知识蒸馏?如何做模型蒸馏?结合案例说明

知识蒸馏是一种模型压缩技术,通过将大型教师模型的知识迁移到小型学生模型中,使其保持高性能的同时降低计算成本。

文章图片
#人工智能
大模型预训练评估指标

关于大模型的量化指标,较为普遍的有 [PPL],[BPC]等,可以简单理解为在生成结果和目标文本之间的 Cross Entropy Loss 上做了一些处理,这种方式可以用来评估模型对「语言模板」的拟合程度即给定一段话,预测后面可能出现哪些合法的、通顺的字词。

文章图片
#人工智能
大模型监督微调SFT流程

在预训练阶段,模型在大规模无标注文本上学到对下一个 token 的分布表示;在下游应用中,通过微调 (fine-tuning)可使模型适应特定任务、领域或风格(如问答、代码生成、对话系统等)。

文章图片
#人工智能
大模型预训练【模型大小】和【数据量】以及【训练成本】如何预估

Scaling-Law 大模型领域的“性能-资源换算表”,让研究者先在小规模实验里“算清楚”,再决定是否大规模投入训练。

文章图片
#人工智能
小龙虾的对话秘密:揭秘OpenClaw如何调用大模型

OpenClaw Gateway流量抓包指南 本文介绍如何使用mitmproxy抓取OpenClaw Gateway的LLM API请求流量。主要步骤包括: 启动mitmproxy(透明模式或Web界面模式) 配置系统代理(临时或永久) 处理HTTPS证书信任问题(关键步骤) 重启OpenClaw服务 测试抓包效果 重点注意事项: 必须配置Node.js信任mitmproxy的CA证书 可过滤特定

文章图片
#人工智能
大语言模型预训练流程

这篇文章介绍下如何从零到一进行预训练工作。

文章图片
#人工智能#自然语言处理
基于 LangGraph 框架实现智能研究助手示例程序

实现一个基于 LangGraph 框架的智能研究助手示例程序,主要功能是构建一个能够回答用户问题的工作流系统。

文章图片
#人工智能#工作流
    共 130 条
  • 1
  • 2
  • 3
  • 13
  • 请选择