logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

一个送外卖的搞了一个世界第三的大模型,会不会搞崩英伟达?——一条被低估的分界线正在成型

6月30日晚上,一位在旧金山做独立开发的工程师朋友给我发了条消息,语气里有种说不清的复杂:"你看到了吗?Meituan,就是那个送外卖的公司,搞了个1.6万亿参数的模型,从头到尾没用一张英伟达卡。几分钟后,他补了一句:"我们这边还在排队等H200的配额。这个时间差可能比大部分人意识到的更有意味。7月2日,两件事同时占据了科技媒体的头条:一边是扎克伯格宣布Meta要把闲置的AI算力挂牌出售,全球硬件

五万星GitHub仓库揭露:主流AI大模型系统提示词全泄露

一个开源仓库,揭开了主流AI模型的"后台剧本"。一周涨了 5 万星。如果你最近刷过 GitHub Trending,大概率已经被这个仓库刷屏了。日均涨星 1,386 颗,600+ 次提交,22 位贡献者——用 CC0-1.0 协议开源,意味着任何人可以随便用、随便改、随便分发。它干的事很简单:把所有主流 AI 模型的系统提示词(System Prompt)扒了个干净,按厂商分目录摆好。Anthro

#github#人工智能#AI
手机跑27B,单卡跑295B:大模型量化部署的iPhone时刻来了

【摘要】2026年7月15日成为大模型量化部署的里程碑节点。PrismML发布3.9GB的1-bit量化版Bonsai27B模型,使27B参数大模型可在12GB内存手机原生运行;腾讯混元同日推出295B旗舰模型的1-bit量化版(85.5GB),单张96GB显卡即可部署,长文理解能力接近原模型。两项突破分别解决端侧"可行性"与服务器侧"实用性"问题,标志大模

#人工智能#语言模型
全球下载第一的开源大模型,居然是一家中国公司的

要理解Qwen为什么能跑赢,光看下载量不够,得看三个细节。第一个细节,是"小而灵"的胜利。报告里有个容易被忽略的数据:1B以下参数的小模型,占历史累计下载量的83%;100B以上的大模型,只占1%。这意味着真正决定生态规模的,不是那几个参数惊人的"明星",而是千千万万个能塞进笔记本、能跑在边缘设备上的小模型。Qwen的GGUF本地部署格式每月下载量达3960万次,接近谷歌Gemma的两倍,是Lla

#开源#人工智能
宇树上市前夜:一只四足机器狗,凭什么撑起两千亿估值

8月17日晚,杭州一家酒店的宴会厅里灯火通明。第二天,宇树科技就要在上交所科创板敲锣,当晚公司包下一场答谢午宴,请来一路同行的伙伴。酒杯碰在一起的声音里,这家成立刚满十年的机器人公司,即将迎来它成立以来最重要的时刻。几天前,路演直播间里,董事长王兴兴说话依旧带着那股子理工男的朴实。有人问他上市之后想干什么,他说得很简单——探索人形机器人、四足机器人、机甲更多产品形态和型号。

#大数据#人工智能
DeepSeek峰谷定价,把算力生意做成了电力生意

凌晨一点,某家创业公司的后端群里又响起一声提醒。负责调模型接口的程序员揉了揉眼睛,看了一眼消息:腾讯云监控提示,DeepSeek API 的调用量在昨天深夜突然飙了一截。他当时只是顺手记了笔"夜班用户多",直到今天上午看到那则公告,才意识到自己赶上的,其实是深度求索酝酿已久的"削峰填谷"。8月17日零点起,DeepSeek API 正式启用峰谷定价:每天上午九点到十二点、下午两点到六点这两个"高峰

#人工智能
十万卡国产算力,第一次把“顶配大模型“递到了普通开发者手里

凌晨两点,杭州一个做量化的小团队的工程师小周,在群里发了一句话:"今晚不睡了,V4 Pro 正式版上了。他说的不是某个海外大厂的发布会,而是 DeepSeek 悄悄在 8 月 13 日深夜放出的那个版本——DeepSeek-V4-Pro-0813。没有舞台,没有直播,只有 API 文档里多出来的一行模型名,和官方群里几张被截图疯传的评测对比表。表里最扎眼的是一行小字:多项测试指标,已经"接近 Fa

#人工智能
DeepSeek 在“心里“叫你“墨墨“:一场关于 AI 内心戏的误会

八月的杭州热得发闷。晚上十一点多,一个年轻人躺在床上刷手机,鬼使神差地打开 DeepSeek 的深度思考模式,问了一个关于自己性格的问题。屏幕上那行灰色的小字开始一行行往外蹦,像一个人在自言自语。然后他愣住了。在一段推理过程里,模型写着:"这位用户喜欢刨根问底,我把它打个标签叫'墨墨'吧。"墨墨"是谁?他不叫这个。他反复看了三遍,确定那个昵称指的就是自己。一股说不上来的感觉涌上来——这个和他聊了一

#人工智能
一台模型给自己造“心脏“:Kimi K3 用 48 小时设计的芯片究竟意味着什么

凌晨两点,一台训练服务器上的进程已经连续运转了整整 48 小时。没有工程师守在屏幕前——因为"工程师"本身也是一套 AI。它正对着一个 45nm 工艺的芯片设计任务,手里的工具是开源的 EDA 软件,面前的目标只有一个:为自己的"同类"设计一块专用芯片。这段场景发生在月之暗面的内部测试里。

#人工智能#facebook
当AI开始给自己出题:一支中国团队把“数据荒“变成了突破口

2026年8月,上海交大人工智能学院的一间实验室里,工程师盯着屏幕上滚动的训练日志,一时分不清是兴奋还是不安。日志显示,一批又一批的训练样本在凌晨两点被自动生成、自动验证、自动入库——整个过程里,没有一位研究员站起来改过一个参数。这些样本不是工程师写的,也不是从网上爬的。它们出自模型自己。这支由上海交大人工智能学院、深势科技和上海算法创新研究院组成的"无尽前沿团队",刚刚发布了BigBang-V1

#人工智能
    共 69 条
  • 1
  • 2
  • 3
  • 7
  • 请选择