logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

从“能写”到“会写”:大模型文本生成能力的跃迁与边界

摘要: 随着大模型文本生成能力的提升,"写得好"与"写得对"的矛盾日益凸显。文章分析了大模型从语言建模(GPT-2)到结构叙事(GPT-4o)的三次跃迁,指出逻辑链压缩、反事实抑制和风格克隆是当前技术的关键支点。然而,模型仍面临事实溯源、价值判断和原创思想的边界问题。作者建议开发者优先考虑可信度而非拟人度,通过结构化输出和风格参数控制来减少幻觉。最终强调,人

#人工智能#深度学习#机器学习 +4
当AI开始“炼丹”:国产大模型“瘦身”30%的幕后技术攻坚战

本文介绍了国产大模型压缩技术的最新实践。面对千亿参数大模型带来的计算资源消耗、推理延迟和端侧部署难题,研究团队通过知识蒸馏、动态稀疏MoE、低秩量化等四层协同技术,将132B参数的"赤霄"模型压缩至46B(精度损失<0.8%)和18B(端侧ROM仅3.8GB)。重点解决了量化异常值、负载不均衡等核心问题,并开源了动态稀疏训练框架SparseLLM等关键组件。文章提出未来将

#人工智能#机器学习#深度学习 +4
从“能写”到“能干活”:大模型工具调用(Function-Calling)的工程化落地指南

摘要:工具调用(Function-Calling)成为2024年大模型落地的关键技术,OpenAI、Anthropic等厂商纷纷布局。文章拆解了工具调用的全流程,并提供了基于OpenAI的30分钟上手Demo。同时指出工业级应用中的6大坑点(如幻觉调包、超时阻塞等)及解决方案,并展望了MCP协议驱动的工具生态。通过智能运维案例,展示了工具调用如何将MTTR从15分钟降至2.1分钟。未来趋势包括多模

#oracle#数据库#人工智能 +4
AI模型压缩新范式:从“剪枝”到“重生”——基于动态稀疏训练的大模型瘦身实战

本文提出动态稀疏训练(DST)方法PaI-2025,通过梯度波动率评估权重重要性,实现LLaMA-7B模型70%稀疏度压缩,性能损失小于1%。相比静态剪枝,PaI-2025支持权重动态重生,在训练过程中持续优化稀疏结构,使模型在参数量减少70%的情况下,推理速度提升2.3倍,显存占用显著降低。实验表明,该方法可在树莓派等边缘设备部署7B大模型(显存占用1.9GB),为AI工程化提供新思路。开源代码

#人工智能#剪枝#深度学习 +4
揭秘“模型编辑”:无需重训,5 分钟改掉 AI 的“坏记忆”——面向大模型的局部参数手术刀与实战

2025年AI大模型仍面临知识幻觉问题,传统微调成本高昂且易导致灾难性遗忘。模型编辑技术(如ROME/MEMIT)通过"参数手术"实现精准知识更新,仅需修改特定神经元权重。中文优化版R-ROME-Chinese引入字符级因果迹和动态模板池,5分钟内完成单条知识编辑(如修正"张衡发明地动仪"),显存<16G,准确率达98.2%且对模型其他能力影响<0.5%。该

#人工智能#机器学习#神经网络 +4
AI“驯服”等离子:深度学习如何驾驭聚变堆的“火龙”?

AI驯服"人造太阳":数字孪生+强化学习突破核聚变控制难题 核聚变作为清洁能源的终极解决方案,面临1.5亿℃等离子体控制的世纪挑战。传统PID控制已无法满足20kHz实时调控需求,AI技术正成为破局关键: 数字孪生:通过MHD方程建模+CNN降阶,RTX4090实现0.8ms/步的超实时仿真; 分层强化学习:高层SAC决策(100Hz)与底层PID执行(20kHz)协同,在EA

#人工智能#深度学习#ide +4
AI“看见”风的形状:基于深度学习的流体可视化与实时超分辨率

摘要: 深度学习超分辨率流体成像(Fluid-SR)技术通过AI实现低成本、高精度的流场测量。传统PIV设备昂贵且空间分辨率低(32×32px),而基于Transformer的Fluid-SR可将分辨率提升至4K,延迟仅8ms,成本降至传统方案的1/100。该技术结合自监督物理损失(如连续性方程)和轻量化网络(Phys-Transformer-Lite),在Jetson边缘设备上实现实时4K流场重

#人工智能#深度学习#机器学习 +4
AI“驯服”光伏云:卫星+深度学习预测沙尘遮蔽,发电量提升7%

针对沙尘导致光伏电站发电骤降问题,研究团队提出基于卫星遥感和VisionTransformer的智能预警方案。通过Himawari-8卫星(0.5km/10min)数据,构建ViT-Temporal模型实现沙尘遮蔽率预测,结合边缘计算(Jetson Orin)形成成本低于1700元的预警系统。关键技术包括:时空注意力机制、自监督预训练、物理约束损失函数,使30分钟预警精度达94.3%(MAPE 4

#人工智能#深度学习#机器学习 +4
AI“点亮”萤火虫:边缘机器学习让微光成像走进4K时代

《微光成像革命:事件相机+Transformer实现4K超分辨率》摘要:本文提出突破性微光成像方案,融合事件相机与Transformer网络,在无补光、低延迟条件下实现4K超分辨率。核心创新包括:1)双分支异构数据处理(1080p微光RGB+1kHz事件流);2)1.6M参数轻量级Event-LowSRTransformer网络;3)自监督训练方法。实测显示该系统在0lux环境下车牌识别率提升48

#人工智能#机器学习#深度学习 +3
从“能看”到“看懂”:多模态大模型如何突破视觉理解的瓶颈

多模态大模型(MLLM)正在突破AI视觉理解的瓶颈,实现从"识别"到"理解"的跨越。本文介绍了MLLM的工作原理,包括视觉编码、跨模态对齐和统一解码三个关键步骤,并展示了其在电商图文质检等场景的应用案例。虽然面临图像分辨率、幻觉问题等技术挑战,但MLLM正向着更高分辨率、更强中文语义理解等方向发展。开源项目如InternVL、Qwen-VL等为开发者提供了快

#人工智能#深度学习#机器学习 +4
    共 494 条
  • 1
  • 2
  • 3
  • 50
  • 请选择