logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

世界模型到底是什么?一文理清Sora、3DGS与JEPA三条技术路线

世界模型关注的不是单纯生成画面,而是让 AI 学习外部环境的底层规律,在行动前预测状态变化。本文将其梳理为三层体系:底层是表示世界、预测未来、规划行动的思想范式;中层是视频、3D 场景或隐状态等具象载体;顶层是作为智能体训练沙盒,服务机器人、自动驾驶与具身智能。文章进一步对比两条技术路线:基于视频生成的方法直观、落地快,但常缺乏显式空间结构;基于 3D 生成的方法更适合几何与物理推理,但数据和算力

文章图片
#3d#人工智能#计算机视觉 +1
据说公认最好的【吴恩达agentic AI】智能体教程笔记

AI Agent是能够感知环境、自主决策、使用工具完成任务的智能体。像人一样,地完成一些工作。如果任务是写一篇论文:大模型:直接写一篇论文人(agentic AI):规划,搜索材料、初稿、批评、成文面试问题:智能体 vs 工作流的区别预先定义好的固定步骤流程,按顺序执行,不能变。特点:死板、确定、可预测。有感知、思考、决策、行动能力的独立个体。特点:灵活、会判断、能自主调整。Models:LLMs

文章图片
#人工智能#AIGC
跑通自己的第一个模型为微调项目【llama-factory + Qwen + ruozhiba】

本文介绍了大模型微调的基本概念与实践方法。主要内容包括:1)大模型微调的分类(监督微调、知识蒸馏、强化学习等)和主流数据格式(Alpaca、ShareGPT);2)核心训练参数说明(训练轮数、学习率、批量大小);3)使用LLaMA-Factory工具进行微调的详细步骤,涵盖环境配置、可视化界面使用、数据集准备和格式修正。文章以Qwen2-1.5B模型和弱智吧QA数据集为例,演示了完整的微调流程,特

文章图片
#人工智能#大数据
跑通自己的第一个模型为微调项目【llama-factory + Qwen + ruozhiba】

本文介绍了大模型微调的基本概念与实践方法。主要内容包括:1)大模型微调的分类(监督微调、知识蒸馏、强化学习等)和主流数据格式(Alpaca、ShareGPT);2)核心训练参数说明(训练轮数、学习率、批量大小);3)使用LLaMA-Factory工具进行微调的详细步骤,涵盖环境配置、可视化界面使用、数据集准备和格式修正。文章以Qwen2-1.5B模型和弱智吧QA数据集为例,演示了完整的微调流程,特

文章图片
#人工智能#大数据
手把手带你跑起来 苍穹外卖前端项目

最后得到vue版本随后进入到项目文件夹,使用命令安装即可第一次写CSDN教程 不是很详细请多见谅我感觉项目跑不起来的主要问题是版本控制,所以在博客里面主要列举了我所下载的工具版本如果遇到其他问题欢迎评论区列出来 一起讨论。

文章图片
#前端#node.js#npm
到底了