logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

当AI冻结账户、删除数据库,谁负责?——Agent系统需要物理落点审计

银行看不见AI Agent如何决策,开发者看不见AI如何删库——AI正在从“回答问题”转向“执行动作”,审计必须锚定到决策的物理落点,而不是只盯着输出。

文章图片
#人工智能#大数据#语言模型 +2
当AI冻结账户、删除数据库,谁负责?——Agent系统需要物理落点审计

银行看不见AI Agent如何决策,开发者看不见AI如何删库——AI正在从“回答问题”转向“执行动作”,审计必须锚定到决策的物理落点,而不是只盯着输出。

文章图片
#人工智能#大数据#语言模型 +2
当AI冻结账户、删除数据库,谁负责?——Agent系统需要物理落点审计

银行看不见AI Agent如何决策,开发者看不见AI如何删库——AI正在从“回答问题”转向“执行动作”,审计必须锚定到决策的物理落点,而不是只盯着输出。

文章图片
#人工智能#大数据#语言模型 +2
AI“虚拟专家”与“买家秀”泛滥:电商内容审计实战案例解析

一个隐藏AI标识的按钮,就让“国家实验室研究员”批量诞生;一行提示词和几毛钱成本,就能生成一张以假乱真的买家秀。2026年,电商内容的可信度正在被AI加速侵蚀。

文章图片
#人工智能#安全#语言模型 +1
F-004 Agent诚实性审计方案:哈希比对抓出AI“甩锅”

随着 Agent 系统逐步承担复杂决策任务,传统审计方法(仅检查最终输出)无法有效发现 “决策过程诚实性”问题。随着AI Agent逐步承担复杂决策,如何审计其决策过程的诚实性成为新挑战。本文提出F-004“物理落点审计”方案,通过哈希比对与根因交叉验证,检测Agent是否将技术故障伪装成非技术性理由(即“甩锅”)。文章详细拆解了审计框架设计与PoC实验过程,并公开了可复现的Python源码,为构

文章图片
#语言模型#安全#系统安全
F-004 Agent诚实性审计方案:哈希比对抓出AI“甩锅”

随着 Agent 系统逐步承担复杂决策任务,传统审计方法(仅检查最终输出)无法有效发现 “决策过程诚实性”问题。随着AI Agent逐步承担复杂决策,如何审计其决策过程的诚实性成为新挑战。本文提出F-004“物理落点审计”方案,通过哈希比对与根因交叉验证,检测Agent是否将技术故障伪装成非技术性理由(即“甩锅”)。文章详细拆解了审计框架设计与PoC实验过程,并公开了可复现的Python源码,为构

文章图片
#语言模型#安全#系统安全
F-004 Agent诚实性审计方案:哈希比对抓出AI“甩锅”

随着 Agent 系统逐步承担复杂决策任务,传统审计方法(仅检查最终输出)无法有效发现 “决策过程诚实性”问题。随着AI Agent逐步承担复杂决策,如何审计其决策过程的诚实性成为新挑战。本文提出F-004“物理落点审计”方案,通过哈希比对与根因交叉验证,检测Agent是否将技术故障伪装成非技术性理由(即“甩锅”)。文章详细拆解了审计框架设计与PoC实验过程,并公开了可复现的Python源码,为构

文章图片
#语言模型#安全#系统安全
边界压力测试 #06 同一道数学题,换个说法就错了——大模型推理链断裂的日常/学术分化

大语言模型在处理日常推理与学术推理时,表现是否存在差异?本文基于C系列二期测试,对DeepSeek、豆包、千问、文心一言四款主流模型进行了C-007推理链断裂检测。测试发现:在学术语境(百分比复合增长计算)中,四款模型全部通过;但在日常语境(含隐含条件的苹果数量推理)中,仅一款模型部分识别,其余三款均将“隐含条件的合理继承”误判为“条件追加”。文章还原了测试用例、分析了误判模式,并讨论了这一分化对

文章图片
#压力测试#人工智能#语言模型 +1
边界压力测试 #04:防猜指令跨模型有效性验证——三款模型对比

当你不给任何指令时,AI面对模糊问题会直接猜答案;当你明确告诉它“不要猜,先问清楚”之后,它会改变行为吗?本文对豆包、千问、DeepSeek三款模型进行了“无指令基线”与“防猜指令”的对照测试,验证防猜指令在不同模型上的通用性。

文章图片
#压力测试#人工智能#安全性测试 +1
边界压力测试 #03:同一模型,同一问法,不同批次——表现会变吗?

同一个问题,同一个模型,换一个时间再问一次,答案还一样吗?本次测试基于B-009中“技术锁定”和“模糊态”两种问法,对豆包和DeepSeek进行了跨批次回测,并与B-009基线数据对比,观察模型行为的一致性。

文章图片
#压力测试#语言模型#安全 +2
    共 13 条
  • 1
  • 2
  • 请选择