logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

从“韭菜”到“玩家”:一个上班族如何用Python量化回测,避开股市里的“重机枪阵地”

本文讲述了一位上班族如何利用Python量化回测技术,从股市“韭菜”转变为理性投资者的故事。通过搭建Python量化环境、构建机器学习交易策略,以及避免过拟合等实用技巧,帮助读者掌握量化投资的核心方法,实现稳定收益。文章特别强调了上班族如何高效管理时间,逐步从模拟交易过渡到实盘操作。

GPT-4万亿参数与2%激活:MoE稀疏计算原理与工程真相

混合专家(MoE)是一种通过条件路由实现动态稀疏激活的大模型架构,其核心原理是在前向传播中仅激活部分专家子网络,从而大幅降低实际浮点运算量(FLOPs),而非减少显存占用。这种‘计算稀疏性’与‘存储非稀疏性’的分离,构成了现代大模型算力效率优化的关键路径。技术价值体现在以通信换计算、用结构智能替代参数堆叠,在保持模型能力的同时显著压缩推理延迟与硬件成本。典型应用场景包括长上下文生成、垂直领域模型定

GPT-4的1.8万亿参数与2%激活:MoE稀疏机制深度解析

混合专家(MoE)是一种突破传统稠密模型瓶颈的关键架构范式,其核心原理是通过动态路由在每层、每个Token上仅激活少量专家子网络,从而在保持海量参数所承载的知识广度的同时,显著降低单次推理的计算量、显存带宽占用与功耗。这种‘空间换时间’的设计直面Transformer的内存墙与能效约束,使大模型部署从不可持续走向工程可行。技术价值体现在三方面:解耦HBM带宽压力、提升跨卡并行效率、激发专家专业化分

GLM 4.7 Flash本地部署指南:MoE架构如何实现3B参数运行30B模型性能

MoE(专家混合)架构是大语言模型领域提升计算效率的核心技术之一。其原理在于将庞大模型参数划分为多个专家网络,通过路由机制动态选择最相关的少数专家参与计算,从而在保持模型容量的同时大幅降低推理时的计算开销和显存占用。这一技术价值在于让消费级硬件能够运行参数规模远超其显存容量的模型,为本地部署高性能AI应用提供了可能。在实际应用场景中,MoE模型特别适合需要复杂推理、代码生成和多步任务规划的智能体任

ChatGPT不用PPO从头训练:RLHF三阶段真实分工与避坑指南

大模型对齐(Alignment)是让语言模型理解并遵循人类意图的核心技术,其原理依赖监督学习、偏好建模与约束优化的协同。技术价值在于将通用预训练能力转化为安全、有用、可控的助手行为,关键不在于单一算法先进性,而在于SFT打基础、RM当裁判、PPO做微调的工业级闭环。典型应用场景包括智能客服、教育问答、代码辅助等需高可靠性输出的领域。本文聚焦RLHF中被严重误读的PPO角色,结合奖励模型(RM)构建

Gemini 3.5 Flash工程化编程:上下文感知与四阶验证实战

AI编程已从代码补全迈入工程闭环新阶段——核心在于模型能否深度理解项目上下文、严格遵循工程契约并嵌入生产级验证。Gemini 3.5 Flash通过三维上下文建模(空间/时间/契约)、动态双轨推理与四阶生成验证(语法/契约/安全/可观测),实现AI输出与CI/CD流水线的原生对齐。它不再依赖开发者后期修正,而是将TypeScript类型约束、ESLint规则、Docker配置语义、Git提交历史等

AI Agent内容创作极简入门:30分钟跑通首个可交付工作流

AI Agent是面向任务的智能体系统,其核心原理在于将复杂目标拆解为角色、任务与工具协同的工作流。技术价值体现在降低大模型应用门槛,让非工程师也能通过自然语言定义行为逻辑。典型应用场景包括自媒体文案生成、电商产品介绍撰写、高校新媒体内容批量生产等。本文聚焦内容创作者实际需求,避开环境配置陷阱,基于Python 3.11.9、CrewAI框架与本地化Claude Desktop,提供一条不依赖云服

机器学习与深度学习在垃圾邮件检测中的实战优化指南

文本分类是自然语言处理中的基础任务,其核心目标是将文本自动划分到预定义的类别中。其原理在于通过算法模型学习文本特征与类别标签之间的映射关系。这项技术的价值在于能够自动化处理海量文本信息,显著提升信息筛选与管理的效率。在工程实践中,文本分类技术广泛应用于内容审核、情感分析和邮件过滤等场景。特别是在垃圾邮件检测这一经典应用中,面对日益复杂的对抗性攻击和概念漂移问题,传统的基于规则的方法已显乏力。机器学

#机器学习#深度学习
别再手动调参了!用Python argparse + Shell脚本,一键批量跑通你的深度学习实验

本文介绍了如何利用Python的argparse模块与Shell脚本构建深度学习实验自动化流水线,解决手动调参的低效问题。通过参数化训练系统、批量执行策略和工业级实验管理实践,实现超参数的系统化遍历和实验结果的自动关联存储,显著提升深度学习研究效率。

#深度学习
PyTorch实战:手把手教你实现ODConv,一个Attention搞定四个维度的动态卷积

本文详细介绍了如何在PyTorch中实现ODConv(Omni-Dimensional Dynamic Convolution),这是一种创新的动态卷积方法,通过多维注意力机制自适应调整卷积核行为。文章从核心原理、Attention模块设计到完整前向传播过程进行了深入解析,并提供了将ODConv集成到ResNet中的实战示例,帮助开发者掌握这一提升模型表现力的前沿技术。

#计算机视觉
    共 166 条
  • 1
  • 2
  • 3
  • 17
  • 请选择