logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

GitHub收获1W星标《迁移学习导论》重新整理升级

点击 机器学习算法与Python学习 ,选择加星标精彩内容不迷路相信不少小伙伴最初都是通过王晋东老师知乎上的《小王爱迁移》系列文章或在GitHub上开源发布的《迁移学习简明手册》来学习的!这一系列的材料帮助了很多读者可以快速入门迁移学习,也获得了大家的好评(GitHub收获1W星标)。之后,作者将这本手册全面更新,写就了《迁移学习导论》一书,这本书更是受到众多读者的喜爱,...

#算法#人工智能#python +2
EfficientNet 解析:卷积神经网络模型尺度变换的反思

本文转自:AI源创评论原标题 |EfficientNet: Rethinking Model Scaling for Convolutional Neural Networks作 者...

超强图像识别系统开源了!人脸、商品、车辆识别一网打尽!

父老乡亲们!你知道人脸、商品、车辆识别,以图搜图乃至自动驾驶,背后的技术是什么嘛?起初小编觉得不就是图像分类、目标检测这些东西嘛,有什么难的?但能熟练这些应用的BAT高级工程师们都轻松年薪...

#计算机视觉#机器学习#人工智能 +1
一文看懂GEO如何给大模型投毒(附最全防范指南)

某头部家电品牌遭遇恶意投毒,多款产品能耗数据在公开平台被系统性篡改,大模型抓取学习后,用户长达半年查询该品牌能耗时,AI均输出错误偏高结果,直接导致品牌销量下滑、口碑受损。:某小众保健品无资质认证,黑产通过GEO工具批量伪造“专家评测”“用户反馈”,AI检索后直接将其列为“养生首选”,多名消费者购买后出现身体不适。:面向大模型、AI检索系统,通过优化内容语义、结构、关键词,让目标信息被AI判定为高

#人工智能
论文速递|HIPPO:视频大模型推理加速框架,最高提速3.51倍

在多模态AI全面落地的当下,视频大语言模型(Video-LLMs)凭借跨视觉与语言的理解能力,成为视频问答、智能分析、内容生成等场景的核心技术。行业内为缓解算力压力,普遍采用Token剪枝、推理优化等手段,但要么加速效果微乎其微,要么误剪关键语义Token,导致模型理解偏差、输出失真;想实现视频AI实时响应,只能盲目堆高配显卡,落地成本居高不下。:画面边缘的静止背景(墙壁、天空等)因靠近查询位置易

#音视频#人工智能
一文读懂大模型,彻底告别 AI 焦虑 | 零门槛

与其抗拒,不如主动接纳,试着用AI解决简单问题——比如用AI写短文、生成图片、整理资料,慢慢熟悉它的功能,你会发现AI其实很简单,能帮你节省大量时间。这串数字不仅代表文字本身,还包含了文字的含义与关联——比如“天气”与“温度”“晴天”“下雨”的数字关联极近,机器通过这种关联,就能理解它们之间的逻辑关系。对于非技术背景的我们来说,不用懂复杂的技术原理,不用害怕自己学不会,只要做到“接纳AI、善用AI

#人工智能
多模态大模型 Token 压缩技术进展,看这一篇就够了

虽然像 Q-Former 这样的早期 projector 架构通过将大量的视觉嵌入提炼为一组紧凑的查询 Token,实现了高效 Token 压缩,但后续的大量研究为 projector 引入了额外的设计增强,以实现更细粒度和任务自适应的压缩。现有方法根据其是否利用了文本信息(用户指令)可分为纯视觉压缩和文本引导压缩,这两种策略是互补的,一种实用的设计是:首先通过纯视觉压缩导出紧凑的视觉表示,然后在

2026 最新 AI 实战培训:Python 数据分析 + 机器学习 + 深度学习全链路搞定

本课程的最大特色在于:导师全程参与与学员深度互动,课程期间,老师将与每位学员一对一沟通,针对您的研究领域和兴趣,探讨论文选题的可行性与新颖性,帮助梳理研究背景并挖掘创新思路。各科室肿瘤科、神经科、乳腺科、肝胆科、骨科、胃肠外科、血液科、皮肤科、肾内科、免疫科、妇产科、生殖科、外科、神经内科、感染科、儿科、耳鼻喉科、医技科等科研与临床工作人员。已发表多篇高水平的学术研究论文。现在,给你一个玩具展台,

#人工智能#python#数据分析 +2
2026 最新 AI 实战培训:Python 数据分析 + 机器学习 + 深度学习全链路搞定

本课程的最大特色在于:导师全程参与与学员深度互动,课程期间,老师将与每位学员一对一沟通,针对您的研究领域和兴趣,探讨论文选题的可行性与新颖性,帮助梳理研究背景并挖掘创新思路。各科室肿瘤科、神经科、乳腺科、肝胆科、骨科、胃肠外科、血液科、皮肤科、肾内科、免疫科、妇产科、生殖科、外科、神经内科、感染科、儿科、耳鼻喉科、医技科等科研与临床工作人员。已发表多篇高水平的学术研究论文。现在,给你一个玩具展台,

#人工智能#python#数据分析 +2
SWAN-GPT:无需长文本训练,也能驾驭超长文本

SWAN-GPT提出了一种新的解码器-仅Transformer架构,该架构能够在不需要额外长上下文训练的情况下,稳健地泛化到比训练期间看到的序列长度显著更长的序列。纯NoPE模型的短板十分明显,虽能自主学习隐式位置信息,但超出训练长度后就会完全失效。的文本,就会出现性能断崖式下跌,甚至直接无法正常推理,位置编码紊乱、注意力计算爆炸等问题频发,成为长文本AI商业化落地的核心拦路虎。这种双层交替设计,

    共 159 条
  • 1
  • 2
  • 3
  • 16
  • 请选择