logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

让 Agent 安全地“借用别人的钥匙“:AgentCore 上用 Authentik 打通 OAuth 出站的一次实战

本文探讨了Amazon Bedrock AgentCore中AI Agent调用需OAuth授权的下游API时的凭证管理难题。对比官方推荐的托管Gateway方案(黑盒、省心但不可控),作者提出自建BFF中间人方案,亲手实现“凭证托管+出站认证”全流程。通过厘清两跳信任链——第一跳为AWS IAM/SigV4,第二跳为OAuth 2.0 client_credentials——揭示token如何从

文章图片
#安全#AI
在ec2上部署qwen3VL2B模型

本文介绍了在AWS EC2 g5.4xlarge实例上部署Qwen3-VL-2B-Instruct模型的环境配置过程。首先安装NVIDIA驱动和CUDA工具包,遭遇了内核版本不兼容问题,最终采用apt方式安装。随后配置容器运行时支持,选择Qwen官方和vllm 0.11镜像,通过挂载模型目录启动容器。文中详细说明了镜像选择考量、依赖安装调整以及vllm引擎的启动参数优化,包括显存控制、并行设置等关

文章图片
#语言模型
使用cline集成aws的mcp服务和搜索功能

文章摘要: 本文介绍了如何在VSCode中使用Cline工具集成AWS相关服务,通过配置MCP服务器实现多种功能。重点包括:1)通过LiteLLM封装自部署模型以降低成本;2)配置文档查询服务用于知识检索;3)集成AWS API服务用于资源管理;4)使用计费管理服务监控成本;5)特定领域工具如IAM策略分析。提供了不同场景的JSON配置模板,包括在线文档助手、资源检索、成本管理等典型用例配置方案,

文章图片
#aws#云计算
在ec2上部署CosyVoice2模型

本文介绍了基于Qwen-Agent项目的CosyVoice2 TTS模型部署过程。测试环境采用AWS g5.4xlarge实例和Ubuntu 24.04系统,通过Docker容器隔离运行环境。重点解决了vllm 0.9.0版本与Python 3.12的兼容性问题,通过conda创建Python 3.10虚拟环境成功运行。文章详细演示了零样本语音克隆、说话人特征保存复用、细粒度控制标记使用以及指令驱

文章图片
在ec2上部署indexTTS和尝试部署sparkTTS模型

本文介绍了IndexTTS-2.0和SparkTTS语音合成模型的部署与使用方法。

文章图片
在ec2上部署deepseekOCR模型

摘要: OCR技术经历了从传统字符识别到多模态理解的演进。传统OCR(1.0)依赖CNN+LSTM结构,仅能提取文本,而现代OCR 2.0(如DeepSeek-OCR、Qwen-VL)结合视觉Transformer和多模态对齐技术,可解析文档结构(表格、公式)并生成Markdown/JSON。DeepSeek-OCR创新性采用"上下文光学压缩"和端到端框架,平衡效率与精度,支持

文章图片
在ec2上部署Qwen2.5omini和Qwen3omini模型

Qwen多模态大模型技术解析 通义千问团队推出的Qwen2.5-Omni和Qwen3-Omni系列模型实现了文本、图像、音频、视频四模态统一建模,支持端到端多模态交互。Qwen2.5-Omni突破音视频同步与流式生成技术,可通过Docker快速部署;Qwen3-Omni采用MoE架构,建议使用vLLM加速推理,其30B版本支持跨模态输入输出,并针对音频描述任务优化。实测显示模型能准确解析混合模态指

文章图片
#AI
在ec2上部署qwen-image模型

本文介绍了在AWS GPU环境下部署Qwen-Image模型的实践过程。测试环境采用4块A10G显卡(24GB显存),使用Docker容器和Kubernetes部署。尝试了两种推理方式:通过diffusers库直接推理时遇到单卡显存不足问题(需20GB以上显存),而ComfyUI方案通过FP8量化模型减少了显存需求,成功在单卡上完成推理(约38秒/图)。实验表明,Qwen-Image模型对显存要求

文章图片
#AI
Kafka Connect集成Apache Iceberg写入AWS Glue表

本文介绍了如何构建从Kafka到S3的数据链路,使用Apache Iceberg表格式和AWS Glue Catalog实现实时数据湖。通过Docker Compose部署Kafka集群,配置Iceberg Kafka Connect插件将流数据写入S3,并自动在Glue中创建表。详细说明了连接器配置参数,包括Glue Catalog设置、S3存储路径和自动建表功能。通过Python脚本模拟数据生

文章图片
#kafka#apache#aws
在Lambda函数中编写和部署MCP服务器的方法

摘要 MCP(Model Context Protocol)定义了客户端与服务端之间的通信机制,支持两种标准化传输方式:stdio和Streamable HTTP。相比早期基于HTTP+SSE的方案,Streamable HTTP通过单一端点简化了实现。在AWS Lambda上部署MCP服务器有三种主要方法:1)使用自定义MCP处理器适配Lambda请求-响应模型;2)通过stdio运行现有MCP

文章图片
#运维#aws
    共 136 条
  • 1
  • 2
  • 3
  • 14
  • 请选择