logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

Wan2.1视频生成模型本地部署完整指南

摘要:阿里云开源的Wan2.1视频生成大模型在VBench榜单综合评分第一,支持文生视频、图生视频等功能,1.3B参数版本仅需8GB显存即可运行。本文提供两种部署方案:ComfyUI可视化部署(适合新手)和原生代码部署(适合开发者),详细说明硬件要求(GPU≥8GB显存)、系统依赖(CUDA≥12.1)及模型下载路径。部署过程包含常见问题解决方案,如FlashAttention报错、显存溢出等,确

文章图片
#音视频#人工智能
从零上手:用AI智能体实现微信自动回复功能全攻略

本文详细介绍了两种实现微信AI自动回复的方案:零代码方案(MsgHelper+Coze)适合非技术人员20分钟快速搭建,通过现成工具实现7×24小时自动响应;轻度开发方案(企业微信API+FastGPT)适合定制化需求,提供更高可控性。文章从核心逻辑、适用场景到具体配置步骤进行拆解,并给出优化技巧和注意事项,帮助个人和企业根据需求选择合适的方案,有效提升沟通效率、降低人力成本。两种方案均可实现精准

文章图片
#人工智能#微信
AI大模型可靠性突破:GPT-5.5幻觉率从52.5%降至26.3%,OpenAI基于深度学习与机器学习的强化学习+对抗验证技术路线全解析

OpenAI 最新论文揭秘 GPT-5.5 如何将幻觉率从 52.5% 砍到 26.3%。本文拆解强化学习对抗训练、验证器架构、推理时采样策略三大技术路线,附完整 Python 复现代码与 YAML 配置模板,适合 LLM 推理工程师与 AI 应用开发者。

文章图片
#人工智能#深度学习#AI
探秘腾讯混元大模型:技术架构、核心能力与实战应用

腾讯Hunyuan是一套覆盖文本、图像、视频与OCR的全模态AI大模型体系,支持云端API调用并通过开源项目推动开发者生态建设。该体系最初以闭源大语言模型形式推出,后逐步开放为云产品并推动技术开源,形成从文本到多模态的完整技术矩阵。Hunyuan-Video采用分层数据过滤和结构化字幕标注技术实现高质量中文视频生成,HunyuanOCR则作为轻量级视觉语言模型专用于高效文字识别。这些能力可组合应用

文章图片
#人工智能#milvus#开源
Mobile-Agent-基于多模态大模型(MLLM)的视觉驱动型GUI智能体

在移动端,让AI真正“会用手机”,已成为人机交互的新前沿。(补充说明)每一代升级都解决了前一阶段的核心瓶颈:v1解决了“能否做”的问题;它的目标是建立统一的GUI语义理解空间,无论Android、iOS还是Windows桌面,都能用同一套逻辑进行操作。此外,系统还支持“Tips”机制——当某次任务失败时,人工可添加提示(如“注意弹窗广告拦截”),这些Tips会被编码进后续推理过程,显著降低同类错误

文章图片
#人工智能
Grok 大模型全景解析:从架构创新到产业实践

从 Grok-1 的开源试水到 Grok-2 的多模态突破,xAI 用不到两年时间证明了 “超大规模模型与开源生态可以共存”。尽管面临计算资源、伦理安全等诸多挑战,但 Grok 以 “开放、实时、高效” 为核心的技术路线,正推动 AI 从 “少数巨头垄断” 向 “开发者共建共享” 转变。对于开发者而言,Grok 不仅是一款强大的 AI 工具,更是研究超大规模模型架构、多模态融合、实时智能的绝佳样本

文章图片
#架构
大模型量化与本地部署:用 llama.cpp 在笔记本上跑 AI — GGUF 量化、Ollama、LangChain 集成全攻略

大模型量化与本地部署实战教程,使用llama.cpp+Ollama在普通笔记本上运行7B大模型。包含GGUF量化格式选择、llama.cpp编译、Ollama部署、LangChain集成、量化对比测试等完整代码,所有命令可直接复制运行。

文章图片
#人工智能#Ollama
vLLM 高性能推理部署:大模型服务化从入门到上线 — 千级并发、毫秒级响应的完整方案

vLLM高性能大模型推理部署实战教程。包含vLLM安装配置、PagedAttention原理、OpenAI兼容API、FastAPI服务封装、Docker容器化、压力测试等完整代码。面向后端开发者,所有代码可直接运行上线。

文章图片
#vLLM
LoRA/QLoRA 微调实战:单卡 GPU 训练自己的大模型,2026 完全指南

2026年微调7B模型成本不到5美元。本文从LoRA原理、数据准备、QLoRA量化训练、超参调优到模型合并部署,提供完整的单卡GPU微调工作流。包含可运行的HuggingFace PEFT代码和踩坑经验总结。

文章图片
#LoRA
DeepSeek 两次降价打到 2 分钱、Kimi 再融 140 亿:2026 中国大模型没有终局,只有下一轮

2026 年 5 月,DeepSeek 连续两次降价至百万 token 仅 2 分钱,Kimi(月之暗面)完成 20 亿美元融资估值破 200 亿,中国大模型赛道进入血腥价格战。本文拆解 DeepSeek V4 API 实战、Kimi K2 能力对比、多模型路由降本方案,附可运行代码。

文章图片
#json#DeepSeek
    共 249 条
  • 1
  • 2
  • 3
  • 25
  • 请选择