logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

询问任务是否完成时,怎么防止AI说谎:不是询问,而是让Agent主动攻击

现在有一群 AI agent 正在实时攻击 Lovable 自己的系统。它们像人类攻击者一样试探每一个入口,不找到一条可验证的漏洞就不停手。这套系统跑得攻击性极强,补上了AI 原生的安全厂商都没补上的空档:AppSec 团队终于能把时间花在真正要紧的 bug 上,负责攻击的研究员也因为找case的脏活被 agent 干掉了,推进速度快了一大截。为了不让这篇文章一上来就制造焦虑,我想先告诉大家。Ag

#人工智能#AI
神秘黑马-莫刻机器人冲榜WorldArena,仅32张真武810E封神

机器人实验室里,这样的画面总是反复出现:屏幕上模拟的机械臂正以完美轨迹移动,但真实世界的一边,玻璃杯还待在桌面上,甚至已被夹爪打翻。今天的机器人世界模型都面临着这样的挑战:夹爪抓不起物体,机械臂无法与环境交互,经过了遮挡之后,预测的画面就完全错了。AI 生成的未来视频每一帧都清晰自然,但内容根本不靠谱。这种现象背后,是具身智能领域的一大悖论:人人在卷的世界模型,物理逻辑却怎么也跟不上。一家成立不到

#机器人#人工智能#深度学习 +1
DeepSeek秘密造芯!专攻推理,一年前已启动,招聘全程不公开

DeepSeek自己造芯片了!目标:降低对英伟达的依赖。路透社消息,这家凭借模型算法震动硅谷的中国AI公司,正在秘密开发一款自研AI芯片。芯片定位是推理而非训练,项目大概在一年前已经启动。当前,该项目还处于早期阶段。消息透露,DeepSeek已与芯片设计公司、晶圆代工厂和存储器供应商展开接洽。

#spring#人工智能#AI
现在主流智能体的工作原理——智能体是怎么解决业务问题的?

但这里有个通用问题,即上下文问题,由于模型本身的限制,上下文会导致模型能力出现浮动,特别是在多轮复杂任务中,智能体可能会丢三落四,解决了这个问题,那个问题又出来了。智能体在接到任务之后,会先分析问题,根据分析结果调用工具,技能来完成任务,再根据执行结果分析是否解决问题或者是否需要进行下一步,这个过程就是自主规划,具体实现是通过死循环的方式实现的。其次,在具体的业务场景中,权限控制也是一个非常重要的

#人工智能#科技#AI
谷歌旗舰大模型难产背后:军方合作引员工不满,内部感叹“已落后”

据新闻网站 Axios 报道,六位现任及前任谷歌 DeepMind 员工透露,员工士气低落是导致谷歌 DeepMind AI 实验室推迟发布模型的原因之一。7 月 24 日,据新闻网站 Axios 报道,六位现任及前任谷歌 DeepMind 员工透露,彭博社此前报道称,谷歌正在开发的最强大模型 Gemini 3.5 Pro 已经落后计划数月。不过,该公司最近确实发布了一系列规模更小、效率更高的模型

#人工智能#AI
AI Agent Skill 工程化 09:让 Skill 自己变好——走向自进化流水线

一句话:让 Skill 走向自动化,需要有要求和约束。本篇只记住三件事:1.自进化的主角是脚手架流水线,不是 Darwin 这个skill。是一套自动流水线:issue → triage → eval → 单假设 →→ KEEP/REVERT,这条链在上已经跑通过。2.没有 fixture,就没有便宜的确定性回归;没有回归,就谈不上放心自动改。3.Darwin 是可选外挂:它帮你提改法,考试规则仍

#人工智能#AI
AI Agent Skill 工程化 09:让 Skill 自己变好——走向自进化流水线

一句话:让 Skill 走向自动化,需要有要求和约束。本篇只记住三件事:1.自进化的主角是脚手架流水线,不是 Darwin 这个skill。是一套自动流水线:issue → triage → eval → 单假设 →→ KEEP/REVERT,这条链在上已经跑通过。2.没有 fixture,就没有便宜的确定性回归;没有回归,就谈不上放心自动改。3.Darwin 是可选外挂:它帮你提改法,考试规则仍

#人工智能#AI
AI Agent Skill 工程化 09:让 Skill 自己变好——走向自进化流水线

一句话:让 Skill 走向自动化,需要有要求和约束。本篇只记住三件事:1.自进化的主角是脚手架流水线,不是 Darwin 这个skill。是一套自动流水线:issue → triage → eval → 单假设 →→ KEEP/REVERT,这条链在上已经跑通过。2.没有 fixture,就没有便宜的确定性回归;没有回归,就谈不上放心自动改。3.Darwin 是可选外挂:它帮你提改法,考试规则仍

#人工智能#AI
谷歌旗舰大模型难产背后:军方合作引员工不满,内部感叹“已落后”

据新闻网站 Axios 报道,六位现任及前任谷歌 DeepMind 员工透露,员工士气低落是导致谷歌 DeepMind AI 实验室推迟发布模型的原因之一。7 月 24 日,据新闻网站 Axios 报道,六位现任及前任谷歌 DeepMind 员工透露,彭博社此前报道称,谷歌正在开发的最强大模型 Gemini 3.5 Pro 已经落后计划数月。不过,该公司最近确实发布了一系列规模更小、效率更高的模型

#人工智能#AI
谷歌发布三款新 AI 模型,含 Gemini 3.6 Flash、3.5 Flash Cyber

公司称,在测试过程中,该模型对知名开源项目 V8 JavaScript Engine 进行了分析,共发现 55 个问题,其中包括 10 个此前其他 AI 模型从未发现过的安全漏洞。与上一代相比,新模型完成相同任务所需的 Token(AI 模型计算资源计量单位)减少了 17%,这意味着开发者可以用更低的成本完成同样的工作。7 月 21 日消息,谷歌今日发布了三款新的人工智能模型,包括性能最强的 Ge

#人工智能#AI
    共 21 条
  • 1
  • 2
  • 3
  • 请选择