DeepSeek识图功能全平台上线,端侧多模态能力优化升级
国内AI大模型平台DeepSeek近期完成了产品功能更新,全新的识图功能已全平台上线使用。该功能适配手机移动端与电脑网页端,升级了底层技术,弥补了平台仅支持文字交互、缺少图片互动的不足。该功能经过长期内测调试、算法优化与合规校验,目前已正式对全体用户开放。
一、全域端口打通,统一端侧识图使用体验
本次更新让DeepSeek各使用端口实现了功能互通,平台统一了移动端与网页端的识图功能入口和运行模式,放开了原本的内测限制,用户可以直接在菜单栏使用该功能,操作变得更加简单。平台优化了设备算力的使用方式,结合本地处理与云端运算,不再依赖高速网络,普通网络也能完成图片解析。该功能支持照片、截图、手绘、图表等多种图片格式,适配大部分手机机型,改善了加载卡顿问题,能够满足用户日常的基础使用需求。

DeepSeek识图功能示意图
二、视觉模型优化,提升图像多维理解水平
和之前的测试版本相比,这次更新对平台的图像识别框架进行了很多调整。该功能不再只是简单识别图片当中的文字内容,除了可以提取图片表面的基础信息之外,也能够读懂图片包含的内在逻辑内容。这次更新改善了过去识别精度不高、适配范围有限的诸多问题,整体提升了平台图片识别的综合能力。
在常规图片处理的过程中,这个功能可以识别数学图形、工作流程图、软件操作界面等规整的图片内容,帮助用户整理图片中的有效信息和逻辑关系。在实景识别方面,生活当中的各类物品、自然风景、工艺藏品等实拍图片,都能够被平台识别,并且解读出对应的基础信息。同时该功能支持多个国家的文字识别,可以完成不同语言的图文转换工作。除此之外,平台制定了相应的管控规则,对人像、私密画面等特殊图片内容进行严格管控,符合网络内容的合规管理标准。
三、贴合大众需求,覆盖多领域日常应用
DeepSeek平台本身有着比较基础的文字处理能力,本次新上线的识图功能可以和文字处理功能相互配合使用。功能的适用范围很广,主要包含学习、办公、生活和技术工作这四个领域,能够为普通用户提供简单又实用的AI图文服务。
在日常学习中,用户可以拍摄习题、黑板板书和纸质学习资料的图片,让平台帮忙梳理知识点,辅助自己的日常学习。在办公工作中,纸质文件、工作报表、会议板书记录的图片,都可以被平台识别并提取有效信息,方便大家整理各类纸质资料。在日常生活中,遇到不认识的动植物、不熟悉的生活用品,只要拍摄图片就可以查询到对应的科普内容。在技术工作中,程序运行界面、手绘的结构草图,也能被平台识别解读,帮助技术工作人员梳理工作思路。
四、行业层面:完善端侧轻量化技术能力,优化多模态布局
识图功能的全平台上线,是DeepSeek在AI图像技术优化方面的一次重要更新升级。本次更新主要优化了轻量化的使用能力,让配置普通的设备和一般的网络环境,也可以流畅使用图文交互功能,大大降低了用户的使用门槛。这次技术更新弥补了平台没办法双向进行图文交互的短板,丰富了国内AI大模型的各类使用场景,也可以为教育、办公等行业的定制化服务提供对应的技术支撑。平台表示,后续会持续优化图像识别的相关算法,一步步完善自身的人机交互能力。
本文是根据DeepSeek官方公开的相关信息和产品实际使用体验整理撰写而成,产品具体功能细节以软件页面的实际展示内容为准。本文内容仅为公开资讯整理,整体内容客观中立,不构成任何商业推广建议。
更多推荐

所有评论(0)