logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

vLLM显存优化

在 vLLM 中,使用梯度检查点的策略会大幅减少中间激活存储在显存中的需求。在实际应用中,你可以根据任务的需求逐步调整这些参数,找到性能和显存消耗的最佳平衡点。如果可能,考虑使用量化后的模型,如 8-bit 或 4-bit 量化,这样可以显著降低显存的占用。:尝试加载量化后的模型(8-bit 或 4-bit),这可以在减少显存使用的同时维持模型的性能。:如果有多块 GPU,使用分布式推理将模型切分

文章图片
#人工智能#机器学习#算法
pycharm和vscode

关于您在使用 PyCharm 时遇到的新问题,即在新建文件中导入模块失败,而在 VSCode 中则正常工作,以下是可能的原因及对应的解决方案。有时,VSCode 使用的解释器或环境与 PyCharm 不同,导致导入问题。确保 PyCharm 使用的 Python 解释器与 VSCode 中使用的相同,尤其是在使用虚拟环境时。为了进一步帮助您排查问题,以下是一个简化的项目示例及其在 PyCharm

文章图片
#pycharm#vscode#ide
qwen vllm function_call

vLLM 是一个高效、易于使用的大型语言模型推理和部署库。自vLLM v0.6.0版本起,它支持工具调用(Tools Calling),允许模型在适当情况下自动解析和调用工具。本文将通过使用Qwen2.5模型的示例,介绍如何利用vLLM实现工具调用,并使用OpenAI兼容API与客户端交互。本教程涵盖了使用vLLM API实现Qwen模型的工具调用功能。通过OpenAI兼容API和Hermes风格

#java
后端开发入门

有时,内置的异常类不足以满足需求,可以定义自定义异常并创建相应的处理器。步骤:定义自定义异常类注册异常处理器在路径操作中抛出自定义异常原子性(Atomicity):事务中的所有操作要么全部完成,要么全部不执行。一致性(Consistency):事务执行前后,数据库都处于一致的状态。隔离性(Isolation):事务的执行不受其他事务的干扰。持久性(Durability):事务一旦提交,结果是永久性

文章图片
#oracle#数据库#网络
DeepSeek学习

奖励函数部分:代码中实现了三个奖励函数,用来衡量生成回答的正确性和格式是否满足要求。这部分代码调用了 Python 内置的re模块和标准数据结构操作。强化学习框架:虽然文件中没有展示完整的 RL 训练循环,但奖励函数的设计正是为 RL 训练服务的。你可以将这些奖励函数嵌入到如 PPO 这类 RL 算法的训练循环中。常用的库包括 Hugging Face 的 Transformers(生成回答)和

文章图片
#学习#windows
PPO学习

基准模型:保持不变,作为原始语言能力的参考。训练模型:根据 PPO 算法被更新,目标是生成高质量且符合奖励标准的文本。奖励模型:为生成的文本提供即时反馈(打分),指导训练模型的更新。状态价值模型:评估当前状态的未来奖励,帮助计算优势,进而指导更稳定、更有效的策略更新。通过这四个模型的协同工作,PPO 能够在微调过程中实现既不偏离预训练知识,又能适应特定任务要求的目标,从而提高大模型的实用性和安全性

文章图片
#学习#人工智能#深度学习
fastapi_jwt_auth 简介

是一个用于 FastAPI 的 JWT 身份验证库。它简化了 JWT 的生成、验证和管理过程,提供了一套易于使用的 API 来处理访问令牌(Access Token)和刷新令牌(Refresh Token)。您可以根据需求自定义验证逻辑和异常处理。

文章图片
#fastapi#网络#linux
poerty结合conda环境

Poetry 是一款专注于 Python 项目依赖管理与打包的工具。它通过文件集中管理项目的依赖、版本锁定以及发布流程,提供了一站式的解决方案,简化了传统的pip或setup.py等工具的使用。本指南详细介绍了如何使用Poetry进行 Python 项目的打包与安装,特别是结合Conda环境管理和上传到私有仓库的实战操作。环境准备:安装并配置 Poetry 和 Conda。项目管理:创建新项目或在

文章图片
#conda#人工智能
vLLM显存优化

在 vLLM 中,使用梯度检查点的策略会大幅减少中间激活存储在显存中的需求。在实际应用中,你可以根据任务的需求逐步调整这些参数,找到性能和显存消耗的最佳平衡点。如果可能,考虑使用量化后的模型,如 8-bit 或 4-bit 量化,这样可以显著降低显存的占用。:尝试加载量化后的模型(8-bit 或 4-bit),这可以在减少显存使用的同时维持模型的性能。:如果有多块 GPU,使用分布式推理将模型切分

文章图片
#人工智能#机器学习#算法
postman测试websocket

当然可以!以下是使用框架创建一个包含 WebSocket 接口的服务,并使用来测试该接口的详细步骤。

文章图片
#postman#websocket#测试工具
    共 12 条
  • 1
  • 2
  • 请选择