logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

爬虫小技巧

爬虫小技巧首先问一下大家都使用过哪些python爬虫模块呢?相信大多数人会回复requests或者scrapy吧,嗯我是说大多人。但是针对简单的爬虫我们还是习惯性的使用requests吧,或者升级版的requests_html,此时再使用scrapy,就有种杀鸡焉用宰牛刀的意味了。现在我们有个简单的要求,去获取该网页http://www.air-level.com/air/beiji...

#爬虫#python
福利爬虫妹子图之获取种子url

import osimport uuidfrom lxml import htmlimport aiofilesimport loggingfrom ruia import Spider, Requestfrom ruia_ua import middlewarefrom aiohttp探究.db import MotorBaseimport datetimedemo...

#爬虫#数据库#操作系统
去哪儿爬虫加数据分析可视化

爬虫import requestsfrom bs4 import BeautifulSoupfrom pymongo import MongoClientclass QuNaEr():def __init__(self, keyword, page=1):self.keyword = keywordself.page = page...

#爬虫#python
数据清洗之微博内容清洗

获取文字加表情(alt标签的属性)#!/usr/bin/env python# encoding: utf-8from functools import reducefrom lxml import htmlfrom bs4 import BeautifulSouphtml="""<div><span class="url-icon"><i...

#python
Apache云服务器性能优化:mod_pagespeed零代码加速实战

Web性能优化是现代网站的核心能力,其本质是通过内容压缩、资源合并、图像转码与智能缓存等技术手段,降低HTTP响应体积、减少请求数量并提升首屏渲染速度。其底层原理依赖于对HTML/CSS/JS及图片的语义化解析与重写,在应用层实现自动化优化。相比CDN或构建工具,该方案具备运行时动态适配、无需修改源码、兼容老旧系统等独特技术价值,特别适用于WordPress、PHP或Django等传统栈在Ubun

AI大模型GPU部署实战:从驱动安装到多卡并行优化全解析

GPU并行计算是人工智能和深度学习的核心基础设施,它通过CUDA架构将大规模并行计算任务分解到数千个流处理器上执行,实现了相比CPU数十倍的性能提升。这一技术原理支撑了现代AI大模型的训练与推理,其价值在于能够高效处理海量参数和数据的复杂计算。在实际应用场景中,从计算机视觉到自然语言处理,GPU加速已成为模型开发的标配。本文聚焦于GPU部署中的显存管理与多卡并行两大关键挑战,通过梯度累积、混合精度

Docker容器停止原理与安全批量终止实践

Docker容器停止并非简单关机,而是基于Linux信号机制(SIGTERM/SIGKILL)的进程协商过程。其核心原理涉及操作系统级信号传递、应用层优雅退出契约、超时控制与时序管理。技术价值在于保障数据一致性、防止资源泄漏、提升环境可重现性。典型应用场景包括本地开发环境快速重置、CI/CD流水线清理、微服务编排停机及故障复现基线准备。本文深入解析过滤(filter)、信号(signal)与可审计

Python深度学习入门:从基础到实践

深度学习作为人工智能的核心技术,通过模拟人脑神经网络实现对复杂数据的建模与分析。其核心原理是通过多层非线性变换自动提取特征,在计算机视觉、自然语言处理等领域展现出强大能力。Python凭借TensorFlow、PyTorch等框架成为深度学习首选语言,其简洁语法和丰富生态显著提升开发效率。本文以Keras框架为例,详细讲解神经网络构建、CNN/RNN等经典架构实现,并涵盖模型部署等工程实践内容,为

#深度学习
Jupyter Notebook环境配置与优化全指南

交互式编程环境是现代数据科学工作流的核心组件,其通过即时反馈机制显著提升开发效率。Jupyter Notebook作为主流解决方案,采用基于单元格的执行模式,支持代码分段运行与可视化输出,特别适合数据分析和机器学习场景。从技术实现看,其基于IPython内核构建,通过WebSocket实现前后端通信,配合conda环境管理可确保依赖隔离。本文以Miniconda为基础,详细介绍Jupyter No

机器人持续学习:克服概念漂移与灾难性遗忘

持续学习是机器学习领域的重要研究方向,旨在使模型在不断学习新任务的同时保留旧知识。其核心挑战包括灾难性遗忘和概念漂移,前者指新任务学习导致旧任务性能下降,后者指数据分布随时间变化导致的模型退化。为解决这些问题,研究者提出了多种技术,如弹性权重巩固(EWC)和动态漂移检测(D3)。这些技术在机器人控制、工业自动化等领域具有广泛应用,如食品处理和粉末称重。通过结合深度学习和物理建模,持续学习技术在实际

    共 109 条
  • 1
  • 2
  • 3
  • 11
  • 请选择