
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
MiniMax冲击“大模型第一股”,不仅是一家公司的胜利,更是中国AI产业的一次“成人礼”。它证明了,在OpenAI等巨头的阴影下,中国企业依然可以通过差异化的技术路线(MoE)、精准的产品定位(情感+生产力)和全球化的市场策略,走出一条独立自主的生存之道。当然,上市只是开始。面对二级市场的波动、全球监管的不确定性以及技术迭代的加速,MiniMax仍面临重重挑战。不仅要仰望星空,更要脚踏实地地赚钱

所谓的“大模型”,全称通常指“大型语言模型”(Large Language Model,简称LLM)。我们可以把它拆解成两个词来理解:“大”和“模型”。1. 它是怎么个“大”法?这里的“大”,指的是参数量巨大和数据量巨大。数据量大:想象一下,如果一个人从出生开始,每分每秒都在看书,把人类历史上所有的互联网文章、书籍、代码、对话记录都看了一遍。这就是大模型的“阅读量”。参数量大:你可以把参数想象成大

上市是里程碑,也是新起点。路还很长,有了资本的粮草,希望能跑得更快。最后,打开 Claude Code 或任意接入 GLM Coding Plan 的编程工具,在输入框中敲下对智谱的祝福「智谱旺旺」,填写收货信息,就能获取🥛 定制旺旺牛奶1罐和🏷️ **智谱上市限量贴纸1套喔。再一次,恭喜智谱!

在科技巨头的AI军备竞赛进入深水区之时,一则重磅人事变动激起了千层浪。据传,OpenAI核心研究员、大模型Agent领域奠基性工作ReAct框架的作者姚顺雨(Shunyu Yao)已正式加入腾讯。这一动作并非简单的人才流动,而是腾讯在AI战略棋盘上落下的一枚关键棋子。它标志着腾讯的AI战略正在从“基础模型构建”向“智能体(Agent)生态落地”发生质的跃迁。图片来源:腾讯滨海大厦背景_腾讯滨海大厦

他们在训练 27B 大小的模型时发现,HC 会导致信号在层间传播时被放大数千倍,或者干脆消失,这就直接导致了训练过程中的 Loss 突然激增,梯度也到处乱跳,非常不稳定。回顾 DeepSeek 这大半年的动作,从登上 Nature 封面的纯强化学习推理研究,到发布 V3.2 对标 GPT-5,再到今天这篇重构底层架构的论文,能看出来这群人是在严肃地做“地基”工作。对于 2026 年的 AI 行业来

Claude Code 刚刚推送了 2.1.0 版本更新。我看了一下更新日志,这次不像之前的版本那样堆砌新功能,更侧重于打磨 Agent 的核心交互逻辑和开发者的实际体验。image.png特别是对 Agent 韧性的增强,让它在处理复杂任务时更像一个成熟的助手,而不是只会报错的脚本。Boris Cherny 也建议大家尽快升级。下面是我整理的几个核心变化,跟大家分享一下。
他们在训练 27B 大小的模型时发现,HC 会导致信号在层间传播时被放大数千倍,或者干脆消失,这就直接导致了训练过程中的 Loss 突然激增,梯度也到处乱跳,非常不稳定。回顾 DeepSeek 这大半年的动作,从登上 Nature 封面的纯强化学习推理研究,到发布 V3.2 对标 GPT-5,再到今天这篇重构底层架构的论文,能看出来这群人是在严肃地做“地基”工作。对于 2026 年的 AI 行业来

试用完扣子2.0,我最大的感受是,AI Agent的竞争,正在从"模型能力"转向"生态构建"。字节跳动凭借它的产品矩阵和用户基础,在这场竞赛中已经占据了有利位置。但对我们普通人来说,更重要的是思考一个问题,当AI可以封装经验、自动执行长期任务,我们的核心竞争力是什么?我觉得,可能是那些无法被封装的创造力、判断力和同理心。**AI可以帮你写代码,但不能帮你决定做什么产品;可以帮你写文案,但不能帮你找
将复杂的AI编程能力封装进一个极简的界面中。对于很多开发者来说,配置各种AI CLI工具(如Claude Code、Codex、Gemini CLI)往往需要繁琐的环境搭建。Zcode巧妙地将这些主流AI编程工具集成在了一起,通过统一的界面实现了无缝切换。这意味着,你可以在同一个窗口内,根据任务的不同,灵活调用不同模型的强项。但Zcode真正的杀手锏在于其Agent问答交互机制。与传统IDE被动等

见证了太多 AI 工具的起起落落。有些昙花一现,有些真正改变了行业。01Agent 属于后者。它不是那种"看起来很酷但用不上"的技术玩具,而是实实在在能帮你省钱、省时间、省心的生产力工具。对于中小电商卖家、独立品牌主、甚至是个人创业者来说,它意味着你终于可以用一个人的力量,撑起一整个设计团队的产出。设计一组电商套图,一个 AI 就够了。这句话,我现在可以负责任地说出来。如果你也受够了传统设计流程的








