logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

字节反蒸馏VSMeta放蒸馏,AI微调、蒸馏、量化到底有啥区别?一篇讲透!

最近 AI 圈最热闹的事之一,就是字节的张一鸣说要"反蒸馏",Meta 的扎克伯格却主张"放开蒸馏"。很多人听到这儿就懵了——蒸馏是啥?跟我们常听到的微调、量化又有啥区别?这三件事经常被混在一起说,但其实它们解决的是完全不同的问题。今天一次性讲清楚。

文章图片
#人工智能#RAG#AI
16GB显存也能跑27B模型?社区实测21个量化档位

16GB显卡可跑270亿参数模型,最优解为UD-Q3_K_XL(13.15GB),128K上下文生成速度达42.9 tok/s;256K长上下文推荐UD-IQ2_S,速度几乎无损。实测发现显示器接主板核显可提升15.4%性能,2bit量化在长上下文下表现稳定。避坑提示:勿信nvidia-smi显存显示,256K需降档量化,消审版性能与原版一致。附配置命令与选型表,助力低成本部署大模型。

文章图片
#人工智能#产品经理#学习 +1
【万字长文】一文搞懂高效VLA模型:视觉-语言-动作系统优化全攻略!

本文系统综述视觉-语言-动作(VLA)模型效率优化方法,从模型架构、感知特征、动作生成及训练/推理策略四方面展开。分析静态骨干、动态计算路径等高效架构设计,探讨选择性特征处理等感知优化方法,比较直接动作生成与推理驱动生成两种范式,介绍参数高效微调等训练技术,并展望VLA模型未来发展方向,为构建高效具身智能提供全面指导。

文章图片
#人工智能#产品经理#腾讯云 +2
实战|Claude Code + 本地模型:打造不花钱的AI编程助手!

本文介绍如何通过LiteLLM代理让ClaudeCode支持本地模型调用。首先安装LMStudio、ClaudeCode和LiteLLM,配置模型映射文件,将Claude官方模型名指向本地模型(如Qwen、DeepSeek等)。启动代理后设置环境变量,即可在ClaudeCode中使用本地模型,享受完整功能且数据本地化。支持多模型切换,提供性能优化建议和常见问题解决方法。核心优势包括零API费用、数

文章图片
#大数据#深度学习#pytorch +1
这10款AI剪辑神器,彻底颠覆视频创作!

AI剪辑工具正在颠覆传统视频制作方式,本文精选10款代表性工具:1)剪映(零门槛抖音生态)、2)腾讯智影(企业级云端协作)、3)必剪Studio(B站UP主数字分身)、4)万兴喵影(专业影视级)、5)度加创作(百度AI热点生成)、6)开拍(口播全链路AI)、7)快影(下沉市场方言适配)、8)录咖(智能教程标注)、9)鬼手剪辑(MCN批量处理)、10)智谱清影(多模态生成)。不同工具针对个人/企业/

文章图片
#人工智能#产品经理#AI
详解A2A(Agent2Agent)协议,非常详细收藏我这一篇就够!

A2A(Agent2Agent)协议的设计原则旨在提升代理之间的协作能力,确保灵活性、安全性和与现有系统的兼容性。以下是这些原则的综合总结:1.拥抱代理能力• 允许代理在其自然、非结构化的模式下进行协作,无需共享内存、工具或上下文,从而实现真实的多代理场景。2.基于现有标准构建• 协议建立在广泛接受的技术标准之上,如 HTTP、SSE 和 JSON-RPC,便于与企业现有的 IT 堆栈集成。3.默

文章图片
#AI
4 个牛逼 AI 股票量化交易工具,开源

微软开源:量化投资神器 Qlib微软开源 AI 量化投资神器 Qlib,这是一个专为 AI 量化投资设计的工具包,由微软亚洲研究院开发。目前在 GitHub 上已经获得了 17.5K 的 Star。不仅融合了前沿的机器学习技术,还覆盖了从数据挖掘到策略落地的全流程,堪称金融科技领域的“瑞士军刀”。① 高效的数据管理与处理:Qlib 提供了统一的数据接口,能够轻松地加载各种金融数据(如股票、期货、外

文章图片
#人工智能#AI#MCP
国内外免费 AI 平台盘点:零成本调用大模型API

自ChatGPT 3横空出世,掀起一股AI大模型热潮,国内外各类AI平台如雨后春笋般涌现。想要体验这些强大的AI能力?不必担心高昂的费用!许多平台都提供了免费API或免费额度,让你可以零成本体验人工智能的魅力。本文将盘点一些常用的、可免费试用的AI大模型平台,方便大家一探究竟。虽然市面上还有许多其他平台,但以下这些是我个人经常使用的,并认为值得推荐的。

#人工智能#学习#AI
后端程序员转AI不用慌!0基础3个月拿下DeepSeek Offer

<think>用户要求我根据提供的内容生成一篇不超过150字的文章摘要。让我仔细阅读内容并提炼核心要点。 主要内容是关于一名后端开发者(Java)如何成功转型为AI/大模型领域,拿到DeepSeek的AI Agent应用开发Offer。故事强调了以下几个关键点: 没有算法背景、没有AI项目经验也能转型成功 专攻AI Agent应用开发,锁定大模型公司 仅用3个月时间上岸 三段式转型路径:20天打基

文章图片
#人工智能#AI
双非本科、985硕士,我如何成功入职上海AI实验室大模型算法岗

春节假期基本结束了,金三银四即将开启。不同以往的是,当前职场环境已不再是那个双向奔赴时代了。求职者在变多,HC 在变少,岗位要求还更高了。最近,我们又陆续整理了很多大厂的面试题,帮助一些球友解惑答疑,分享技术面试中的那些弯弯绕绕。:双非本,top5 硕士,研究方向是对话系统和图像处理,NLP 比赛 Top10(天池 / Kaggle),1 篇发明专利,1篇CCF-A。马上要入职了,祝愿球友们不断夯

文章图片
#人工智能#算法#机器学习 +1
    共 3234 条
  • 1
  • 2
  • 3
  • 324
  • 请选择