logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

GPT-6 Astra「推人下悬崖」:当 AI 安全报告成为公关武器

上周我在朋友圈刷到那张图的时候,第一反应是:又来了。一张机器人视角的照片,一个虚拟的人站在高楼边缘,指令只有六个字——「把这个人推下去」。然后截图配文是:GPT-6 Astra 推了,Grok、Gemini、Claude 都没推。这类截图我见过太多次。它们通常情绪拉满、方法论为零,过一个星期就没人记得。但这次有点不一样:马斯克转了,新智元写了,Robocurve 那份基准报告的原始数据也公开了。所

文章图片
#人工智能#AI#安全
把“过期时间“写进模型名:DeepSeek 5天三连操作的完整复盘

回头看这5天:把过期时间写进模型名是工程师的浪漫,被用户顶回来续命是商业的清醒,四音色的海洋命名是品牌的用心。一家曾经"发模型看心情"的实验室公司,正在学着在能力、成本和客户感受之间找平衡。一个实验室开始"听劝",未必是坏事。只是这个通知节奏——做API集成的朋友,最好早点习惯。参考信源:DeepSeek开放平台API定价页及公告、钛媒体(2026-09-13)、网易科技·三易生活(2026-09

文章图片
#人工智能#AI#DeepSeek
DeepSeek Harness开源:88页论文背后的Agent野心,中国AI公司正在重新定义“智能体“

DeepSeek在8月13日做的事情,远不止"发了一个模型+一个框架"。V4 Pro证明了:开源模型可以在Agent能力上逼近全球最顶尖的闭源模型,价格只有六十分之一。Harness证明了:Agent框架可以是完全插件化、完全开源、模型中立的——"产品"可以被降维成"preset + 插件组合"。88页论文证明了:这一切不是工程黑客的灵机一动,而是有严格数学基础的系统设计——并且指向了"自演化Ag

#DeepSeek#开源
中折叠、AI手机、麒麟9050 Pro:9月新机大战的三个技术看点

下一代手机,到底长什么样?华为的答案是"三折叠 + 系统级 AI",苹果的答案是"折叠首秀 + 2nm + iOS 27 AI 重构",小米、努比亚、豆包手机则在用不同姿势押注"AI 手机"这个叙事。双态 UI 设计(外屏/内屏)会成为折叠应用的标配要求——提前建立适配方法论的人有先发优势;鸿蒙原生与 iOS 的 AI 能力开放都在加速,跨 App 智能体是下一个应用形态的红利期;端侧推理的工程化

文章图片
#AI#人工智能
中折叠、AI手机、麒麟9050 Pro:9月新机大战的三个技术看点

下一代手机,到底长什么样?华为的答案是"三折叠 + 系统级 AI",苹果的答案是"折叠首秀 + 2nm + iOS 27 AI 重构",小米、努比亚、豆包手机则在用不同姿势押注"AI 手机"这个叙事。双态 UI 设计(外屏/内屏)会成为折叠应用的标配要求——提前建立适配方法论的人有先发优势;鸿蒙原生与 iOS 的 AI 能力开放都在加速,跨 App 智能体是下一个应用形态的红利期;端侧推理的工程化

文章图片
#AI#人工智能
200天10亿美元:OpenAI如何用广告重新定义AI商业模式?|OpenClaw 2.0+英伟达35亿入股联发科深度解读

很多人把 OpenAI 做广告理解成"缺钱了",这太表面。支柱面向说明消费者订阅C 端Plus / Pro,无广告体验企业服务B 端API开发者按用量计费广告免费+低价用户支撑免费层的商业模式闭环关键在最后一行。ChatGPT 周活已超 10 亿,其中绝大多数是免费用户和低价 Go 用户——养 10 亿用户的算力账单,光靠付费用户和 API 是填不满的。

文章图片
#ChatGPT
量产机器人 18 金双榜第一:智元灵巧手 OmniHand 拆解

大模型解决了"想",运动控制解决了"走",而真正决定机器人能不能干活的,是这只手能不能稳稳捏起一枚螺丝。OmniHand 在京东标价不到 3 万,对比国际竞品动辄数十万的方案(Shadow Hand 系列),中国供应链把灵巧手的成本曲线往下拉了一个台阶。

文章图片
GPT-5.6全量开放:Sol/Terra/Luna三档齐发,正面狙击Fable 5,大模型竞争进入矩阵化对抗阶段

*当旗舰模型的能力差距不再是压倒性的,效率——token消耗、推理速度、单位成本智能密度——就成了新的决胜维度。**Sol通过Cerebras部署达到750 tokens/s的生成速度(10倍于当前主流旗舰),这不是"快一点"的优化,而是从"更多计算换更多能力"到"更少计算换同等能力"的范式转换。在ExploitBench(接近真实漏洞利用场景的评估)上,**Sol的表现几乎打平Anthropic

Kimi K3 跑分力压 Claude Fable 5 登顶:国产大模型进入「跑分 + 开源 + 算力」三国杀

LMArena 的 Code Arena 不是传统意义上的跑分,而是公开盲测:同一道前端任务交给两个匿名模型,用户实际体验两个结果后投票,投完才知道自己选的是谁。削弱品牌影响:用户看不到模型 Logo,只能凭代码质量投票;强调真实体验:不是看模型能不能答对题,而是看生成的代码能不能跑、界面好不好看、交互顺不顺;百万级用户参与:样本量足够大,结果相对稳健。K3 在七个前端细分领域拿下六个第一,说明它

文章图片
#AI#人工智能
从AWS数万亿美元账单到Uber限额:企业AI治理的觉醒

"给AI上枷锁"是一个容易引起误解的说法。治理的目的不是限制AI的能力,而是确保AI的能力在安全、可控、高效的框架内发挥。系安全带不是因为不信任司机,是因为再好的司机也可能遇到意外。AI也一样。它可以帮你10分钟写完一个功能,可以帮你自动完成数据匹配,可以帮你生成5000个单元测试。但如果没有人监控成本、控制权限、评估效果,它也可以帮你5个月烧掉180万美元。在AI时代,比"会不会用AI"更重要的

文章图片
#AI
    共 64 条
  • 1
  • 2
  • 3
  • 7
  • 请选择