logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

宪法分类器(Constitutional Classifiers)–大模型安全领域的新魔法

宪法分类器(Constitutional Classifiers)是 Anthropic 于 2025 年 2 月提出的一种大模型安全防护方法,其核心思路是:用自然语言编写的"宪法"(一组安全规则)来指导合成训练数据的生成,进而训练出输入/输出安全分类器,在不修改基础模型的前提下防御通用越狱攻击。宪法分类器是一种基于外部分类器的双层安全防护系统,由 Anthropic 安全研究团队(Safegua

文章图片
#人工智能#机器学习#深度学习 +1
DeepSeek Harness 深度调研报告

Claude Code 是一台精密瑞士手表:齿轮不能换,但表盘、表带、表冠给了标准接口(Skills/MCP/Hooks/Subagents/Agent Teams)。Codex 是硬核工程车:Rust 内核 + 双形态(本地 CLI/云端),扩展走 MCP + AGENTS.md + 配置。没有成品,全是积木,连"组装方式"本身都可以换。【VERIFIED - 行业对比文章共识】

文章图片
#人工智能
DeepSeek Harness 深度调研报告

Claude Code 是一台精密瑞士手表:齿轮不能换,但表盘、表带、表冠给了标准接口(Skills/MCP/Hooks/Subagents/Agent Teams)。Codex 是硬核工程车:Rust 内核 + 双形态(本地 CLI/云端),扩展走 MCP + AGENTS.md + 配置。没有成品,全是积木,连"组装方式"本身都可以换。【VERIFIED - 行业对比文章共识】

文章图片
#人工智能
DeepSeek Harness 深度调研报告

Claude Code 是一台精密瑞士手表:齿轮不能换,但表盘、表带、表冠给了标准接口(Skills/MCP/Hooks/Subagents/Agent Teams)。Codex 是硬核工程车:Rust 内核 + 双形态(本地 CLI/云端),扩展走 MCP + AGENTS.md + 配置。没有成品,全是积木,连"组装方式"本身都可以换。【VERIFIED - 行业对比文章共识】

文章图片
#人工智能
DeepSeek Harness 深度调研报告

Claude Code 是一台精密瑞士手表:齿轮不能换,但表盘、表带、表冠给了标准接口(Skills/MCP/Hooks/Subagents/Agent Teams)。Codex 是硬核工程车:Rust 内核 + 双形态(本地 CLI/云端),扩展走 MCP + AGENTS.md + 配置。没有成品,全是积木,连"组装方式"本身都可以换。【VERIFIED - 行业对比文章共识】

文章图片
#人工智能
Pi Agent 源代码流转分析

│ packages/coding-agent (CLI 应用)││工具: read/write/edit/bash/grep/find/ls│↓ 持有│ packages/agent (代理运行时)││钩子: beforeToolCall / afterToolCall / prepareNextTurn│。

#人工智能
Claude Code Loop Engineering 深度研究报告

Claude Code 的 Loop Engineering 涵盖了三层循环架构层级名称定位核心机制L1核心 Agentic Loop每一次响应的执行循环Gather → Act → Verify 三阶段L2调度循环系统跨会话的任务调度/loop(cron)//goal(Stop hook)/ ScheduleWakeup(自适应)L3编排层大规模多 Agent 编排Dynamic Workflo

#人工智能
AI Agent 实现框架深度调研

2024-2026 年是 AI Agent 框架的爆发期。从 LangChain 开创 LLM 应用编排范式,到微软 Semantic Kernel 和 AutoGen、Google ADK、OpenAI Agents SDK 等重量级玩家的加入,Agent 框架生态呈现出"百舸争流"的格局。选择一个合适的框架对于 AI Agent 项目的成败至关重要。协议标准化— MCP 和 A2A 正在成为行

#人工智能
通过构建 Validation Engineering 提升 Claude Code 自动化任务执行准确性——AI Coding 质量控制与研发效率深度研究报告

Agent 无法准确评估自身产出的质量。瓶颈描述来源出码率 ≠ 交付率编码仅占全链路 20%-30%,AI 渗透率提升编码环节并不等于整体提效高德大模型应用平台团队 2025 云栖大会分享Vibe Coding 风险"氛围编程"在存量应用中可能引入与现有系统不兼容的方案,问题常在上线后暴露腾讯云开发者社区 2026大任务超出能力边界复杂多模块任务超出单次 AI 对话能力,上下文窗口填充率超 40%

#人工智能#自动化#运维 +1
AI Agent 执行路径规划深度研究

1. 执行路径规划是Agent智能的核心维度。从STRIPS到DeepSeek R1,54年的演进历史表明:Agent的"聪明"不在于模型的参数量,而在于它如何规划、执行和验证自己的行动路径。2. LLM单独无法可靠规划。PlanBench的数据以令人震惊的清晰度证明了这一点——所有传统LLM在Mystery Blocksworld上准确率为0%或接近0%。但推理模型(o1, DeepSeek R

#人工智能#AI
    共 31 条
  • 1
  • 2
  • 3
  • 4
  • 请选择