logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

吃透代码智能体!北航副教授拆解 AI 开发全链路技术|算泥MVP直播

随着代码基础模型飞速迭代,软件开发模式正在迎来颠覆性变革。从代码补全工具到具备自主调试、迭代能力的代码智能体,整套技术体系值得每一位开发者深度研究。本期算泥社区MVP直播特邀,带来专题分享《从代码大模型到代码智能体》,完整梳理代码 AI 技术演进全路径。

#人工智能
DeepSeek推理再提速80%,V4正式版定档7月中旬

DeepSeek两天前开源了DSpark推理加速框架,梁文锋署名。DSpark已经在V4预览版的在线服务上跑了真实流量,把每个用户感受到的生成速度拉高了60%到85%。DSpark用半自回归结构和置信度调度两套机制,化解了推测解码长久以来的尾部衰减与算力浪费问题,在Qwen3和Gemma4多个目标模型上稳定超过Eagle3和DFlash。而刚刚,DeepSeek-V4正式版官宣定档7月中旬,也将受

#人工智能
阶跃开源JetSpec,大模型推测解码提速近10倍

随着 Agent 应用爆发,大模型推理效率问题成为 AI 行业焦点。当基础能力逐渐够用后,效率就成了新的主战场。推理效率决定了模型能被怎样调用、是否普遍用得起、能铺多广。近期,除了 DeepSeek 开源 DSpark 推理加速框架,阶跃星辰(StepFun)也联合加州大学圣地亚哥分校、浙江大学、伊利诺伊大学、南京大学团队开源了 JetSpec。JetSpec 在 H100 上把 MATH-500

#人工智能
算泥AI开发者社区MVP招募重磅启动!AI领域顶尖人才专属权益,邀你共建技术生态!

审核通过后,您将正式成为社区 MVP 领袖,解锁专属权益。让我们携手并肩,在 AI技术的浪潮中领航前行,共建开放创新的技术生态,共创智能未来!社区特殊荣誉标识:获得官方认证 MVP 称号、专属徽章及认证证书,彰显技术实力;年度荣誉认证:有机会登榜 “年度 MVP 之星”,颁发官方专家认证证书;技术先机获取:提前解锁最新 AI 技术预览权,参与产品功能测试与改进;高端人脉链接:优先参与闭门技术沙龙、

#人工智能
AI视觉原生统一!商汤开源视觉任务大统一模型SenseNova-Vision

7月13日,商汤科技正式发布并全面开源日日新 SenseNova-Vision 理解生成统一视觉大模型,这是商汤日日新大模型体系的重要视觉能力升级。该模型将计算机视觉任务统一建模为多模态生成问题,首次在单一共享表征空间内原生覆盖结构化视觉理解、稠密几何预测、图像分割与多视角3D几何等经典视觉任务,并以单模型在多项权威评测中比肩甚至超越专用专家模型。

#人工智能
震惊硅谷的Kimi K3正式开源!全球Day 0适配

Kimi K3 正式开源!完整权重放到 Hugging Face 上,1小时内就登上趋势榜第一。全球第一个开源的3万亿参数级别模型,编程和Agent能力逼近 Claude Fable 5 和 GPT-5.6 Sol,而推理成本只有后者的几分之一。发布即震惊硅谷,惊呼为下一个DeepSeek时刻。甚至导致美国开始考虑封禁中国开源模型。黄仁勋、马斯克等一众全球大佬力挺开源。英伟达甚至与37家科技巨头建

#开源
Claude Opus 5发布,砍掉了Claude Code 80%的系统提示词

Anthropic 发布了 Claude Opus 5,接近 Claude Fable 5 的前沿智能,价格减半。测评成绩上大幅超过 Opus 4.8,甚至许多测评高于 Fable 5。Anthropic 同时公布了一个惊人发现,模型够聪明之后,你写的那些规矩,反而在拖后腿。Claude Code 的系统提示词,砍掉了80%以上,编码评测分数则完全不变。

#人工智能
阿里通义开源GUI智能体SOTA:2B到235B端云协同重新定义移动端GUI智能体

阿里通义实验室开源MAI-UI,从2B到235B全尺寸模型破解真实世界部署难题。MAI-UI通过引入端云协同架构、自进化数据管线及扩展的MCP动作空间,在兼顾隐私与效率的同时,全面解决了GUI智能体在真实动态环境中的部署难题。在手机任务执行能力上,在 AndroidWorld、MobileWorld 等真实导向的基准上,MAI-UI 均创下新的 SOTA性能超越UI-Tars-2、Gemini-2

#人工智能
腾讯开源 HunyuanOCR,用纯粹视觉语言模型架构,仅1B参数刷新多项高阶任务SOTA

HunyuanOCR 将原本割裂的 OCR 任务统一到了自然语言指令的框架下。在文本定位(Spotting)任务中,用户只需输入固定指令:Detect and recognize text in the image...。模型便会输出结构化的格式。坐标被归一化到 [0, 1000],无论图片分辨率如何,输出坐标始终精确对应。文档解析(Parsing)任务被细化到了极致。遇到数学公式,模型输出标准的

文章图片
#语言模型#架构#人工智能
谷歌3连发!Gemini 3.5 Pro已在路上,最强Gemini 4已启动训练

Google刚刚一口气发布了3款Gemini新模型Gemini 3.6 Flash、3.5 Flash-Lite、3.5 Flash Cyber。3.6 Flash用更少的Token干更多的活,3.5 Flash-Lite把输出速度拉到每秒350个Token,3.5 Flash Cyber则专攻代码安全漏洞的发现和修复。三款模型,三个方向,目标一致:让AI Agent在生产环境里真正跑起来,跑得起

#人工智能
    共 900 条
  • 1
  • 2
  • 3
  • 90
  • 请选择