
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
提供人工智能及强化学习基础网络设计及知识传递服务
如果你第一次听到“训练大模型”,脑海里可能会自动浮现一排显卡、嗡嗡作响的机房、以及一张看起来不太友好的云账单。好消息是:我们今天不训练一个真正能上生产的 ChatGPT,也不挑战算力预算的物理极限。我们要做的是把大模型训练流程缩小成一个可以亲手跑通的“训练沙盘”。

当多个智能体(机器人、无人车或智能体)通过共享信息来协作完成任务时,一个自然的问题是:当共享的信息由于延迟,异步等情况,晚到几步,是否还有好的价值? 车联网领域近期的研究表明:新鲜的协作信息价值巨大;价值随延迟迅速衰减,甚至变成负资产(比不用还差)!;在计算与通信双预算约束下,刷新信息的机制存在可优化的空间;且这种优化规律和机制可以被神经网络学到。

6.10凌晨1点,Claude发布了Fable 5,号称是Claude向大众发布过的能力最强的模型。Fable 5属于Mythos系列,只是为了大众使用,在安全上做了一些限制。

如果你第一次听到“训练大模型”,脑海里可能会自动浮现一排显卡、嗡嗡作响的机房、以及一张看起来不太友好的云账单。好消息是:我们今天不训练一个真正能上生产的 ChatGPT,也不挑战算力预算的物理极限。我们要做的是把大模型训练流程缩小成一个可以亲手跑通的“训练沙盘”。

**从 2024 年底到 2026 年春天,不到一年半的时间,科研,尤其是对于独立研究工作者,这件事已经跟过去完全不是一回事了。****如果要在整个科研史上画一条分界线,2024 年底可能算一条。那之前,AI 是"辅助":是 Copilot 帮着补全一行代码,是 ChatGPT 帮着润色一段英文。那之后,AI 开始变成"主角":它写代码,复现论文,跑实验,一次性读完整个代码仓库,然后指出里面某个算

6.10凌晨1点,Claude发布了Fable 5,号称是Claude向大众发布过的能力最强的模型。Fable 5属于Mythos系列,只是为了大众使用,在安全上做了一些限制。

6.10凌晨1点,Claude发布了Fable 5,号称是Claude向大众发布过的能力最强的模型。Fable 5属于Mythos系列,只是为了大众使用,在安全上做了一些限制。

如果你第一次听到“训练大模型”,脑海里可能会自动浮现一排显卡、嗡嗡作响的机房、以及一张看起来不太友好的云账单。好消息是:我们今天不训练一个真正能上生产的 ChatGPT,也不挑战算力预算的物理极限。我们要做的是把大模型训练流程缩小成一个可以亲手跑通的“训练沙盘”。

如果你第一次听到“训练大模型”,脑海里可能会自动浮现一排显卡、嗡嗡作响的机房、以及一张看起来不太友好的云账单。好消息是:我们今天不训练一个真正能上生产的 ChatGPT,也不挑战算力预算的物理极限。我们要做的是把大模型训练流程缩小成一个可以亲手跑通的“训练沙盘”。

2025年6月4日,是我在CSDN写下第一篇技术博客的第1024天。1024,这个数字对于程序员来说意义非凡,它不仅是内存单位的基础,更是我们这群“码农”的节日符号。而对我来说,它更像是一段旅程的里程碑:从一个曾想过本科毕业直接就业的本科生,到现在人工智能方向博士生,我在这条创作与探索的路上,已经走了整整1024天。这1024天里,我写过Matlab命令整理、Python算法实现、深度学习模型搭建








