登录社区云,与社区用户共同成长
邀请您加入社区
摘要 AI Agent的能力具有"攻防二元性"特性,即同一能力既可用于防御也可能被用于攻击。本文从工具调用、自主规划和长期记忆三类典型能力出发,分析了能力增强带来的双向影响,指出单纯增加能力而不加强权限控制反而会扩大攻击面。作者提出应从"控制能力"转向"控制用途",建议通过工具级、数据级和任务级三重边界设计来管理风险,并推荐采用"能力双向评估表"进行威胁建模。关键观点是:Agent的安全有效性取决
【摘要】gongwen-skill 是一款功能强大却鲜为人知的中文公文处理开源工具,专为体制内工作者设计。它严格遵循 GB/T 9704 国家标准,支持 24 种公文类型,通过命令行实现全流程自动化处理:一键生成标准模板、自动检查修复格式、Markdown 转正式公文、智能注入红头版记、原生修订批注、事实核验防错等核心功能。其特色包括 8 色审阅角色体系、6 套公文风格适配、AI Agent 原生
在AI科研工具爆发的当下,多数工具存在场景单一、领域局限、兼容性差、技能碎片化的痛点。此前大火的 academic-research-skills(ARS)仅聚焦通用论文写作流程,无法支撑垂直硬核科研场景。而 scientific-agent-skills 由 K-Dense-AI 团队开源,是目前覆盖领域最广、技能数量最多、兼容性最强的标准化AI科研技能库,核心定位:将任意兼容Agent标准的A
本文对 academic-research-skills 项目进行静态工程审阅,分析了其作为学术研究自动化工具的技术实现特点。项目以Python为主(占比97.8%),包含4个核心技能模块(深度研究、论文写作、论文评审和流程编排),形成完整的研究工作流。工程结构包含hooks守卫、scripts处理逻辑、tests测试等分层设计,展现出较强的流程化特征。静态分析发现项目包含大量输入校验、文件处理和
本文介绍了mattpocock/skills项目,这是一个专注于提升AI编程代理工程能力的开源工具集。该项目通过35个Markdown格式的"Agent Skills"文件,为AI编程代理提供清晰的工程规范和工作流程指导,包括需求确认、测试驱动开发、故障诊断等关键环节。每个Skill都是一个独立文件夹,包含YAML元数据和详细指令,可组合使用形成完整开发流程。项目要求Node.js环境,通过npx
【项目简介】:一个连接 AI Agent 与前端 UI 的开源框架,并推动了 AG-UI 协议的建立。【关键数据】CopilotKit34.5K Star(官网实时数据,高于前一版本的 32K)。AG-UI 协议15.1K Star1.4K Fork。采纳方:Google、LangChain、AWS、Microsoft 等。【深度复盘】协议先行。
推理日志的质量取决于埋点的位置。埋点位置事件类型必须记录的内容每步规划生成后agent.plan生成的计划文本、计划步骤数、是否包含工具调用每次工具选择时候选工具列表、选择结果、拒绝理由每次工具调用前后工具名、参数、返回结果、耗时、错误模型判断「需要重试」时重试原因、重试次数、重试前后的差异模型自我纠错时发现了什么错误、如何修正、修正是否成功上下文被压缩/截断时压缩前 token 数、压缩后 to
九个新面孔里有三个都在给 AI 编程 agent 补能力:ai-memory 管长期记忆,career-ops 管求职流程,Anthropic-Cybersecurity-Skills 管安全技能。v1.3.4 这版把任务生命周期在 API、CLI、WebUI 三端统一,断掉的任务能恢复,社交发布也跟视频生成解耦了。自主 AI 渗透测试工具,让一群 AI agent 像红队一样协作,侦察、利用、后
从第 113 期的。
如果你用过Claude Code、Cursor、Codex这些AI编程助手,你一定遇到过这种情况:AI写的代码能跑,但质量一言难尽——没有测试、不写文档、命名乱来、架构全靠缘分。Agent Skill就是解决这个问题的。简单说,它是一份SKILL.md文件,告诉AI"你应该怎么做这件事"。写代码之前先问清楚需求(别我还没说完你就开始写了)每次改动都要跑测试(别写完就跑路)代码审查要按严重级别分类(
摘要:Matt Pocock提出两个AI编程技能——codebase-design和domain-modeling,帮助AI理解复杂代码库。前者通过"深模块"原则(接口小实现大)优化代码结构,后者统一术语定义建立项目词典。二者配合使用,让AI在开发时能快速定位代码功能,避免在混乱的代码库中迷失方向。这种方法既保持代码的整洁性,又提高了AI协作效率,特别适合处理历史遗留系统的改造
Flydb是一款专为信创与多数据库环境设计的轻量级迁移工具,解决了传统工具兼容性问题。采用Apache-2.0开源协议,纯Java8实现且零依赖,深度适配国产信创数据库及主流关系型数据库。项目创新性地结合AI能力,提供AgentSkill技能族支持智能迁移与运维。现已开源并上线GitHub(zzxCoding/Flydb),配套技能可通过SkillHub一键安装,支持版本管理、脚本编写及CI/CD
本期 GitHub 周榜收录 16 个热门开源项目,Python 占据主导(7 个项目),智能体相关项目表现突出。新增 star 总数 54,823,亮点包括: 智能体工具链:3 类智能体项目集中上榜,涵盖技能包(diagram-design、agent-skills)、执行环境(cloudflare/computer)和记忆系统(TencentDB-Agent-Memory),反映社区从模型能力
本期 GitHub 热榜明显聚焦 AI Agent 工程化:从 agent-skills、prime-agent 到 Cloudflare computer,强调可执行、可长期运行的自动化工作流;同时,知识图谱 RAG、Agent Memory、Switchyard 等项目表明模型路由、记忆治理与上下文管理正成核心基础设施。另有小模型端侧部署、低代码内建 AI 和可视化表达工具升温,说明行业正从“
本文基于Valhalla Alchemy V2编译器级AST萃取,对Trending #2开源项目semantica‑agi/semantica完成深度源码审计。它是面向AI Agent的图原生可审计基础设施,原生支持W3C PROV‑O溯源、SHACL本体约束、Datalog确定性推理。文章给出量化评分、架构拆解、风险提示、POC落地步骤,为企业Agent平台选型提供可复现的工程证据。
Harness Engineering,也可以叫 Agent 驾驭工程,是围绕 AI Agent 构建工作环境的一套工程方法。它主要包括:上下文管理;工具调用;任务状态管理;沙箱环境;权限控制;测试验证;日志观测;代码评审;反馈回路;人工干预和回滚机制。它的目标不是让模型“回答得更好看”,而是让 Agent 在真实工程系统里:能理解任务;能读取必要上下文;能调用合适工具;能安全修改代码;能运行测试
本指南介绍如何利用HFish蜜罐、Python和GitHub Pages构建自动化威胁情报系统。主要内容包括:部署HFish蜜罐捕获攻击数据,编写Python脚本清洗处理数据并生成结构化情报,通过GitHub Pages实现可视化展示。该系统可实现全流程自动化,零成本搭建私人或企业级威胁情报源,帮助安全人员快速感知威胁。适用具备基础技术能力的安全运维人员或研究者,需准备Linux服务器、Pytho
前面几篇文章中,从不同角度学习了 Open Code Review 的核心流程。第一篇从使用者角度跑通了最小 Demo,观察到了ocr reviewfile_readfile_findfile_read 用来读取文件;code_search 用来搜索代码;code_comment 用来生成评论。第二篇分析了ocr review命令入口,知道了命令会从main.goGit diff 决定本次审查哪些
5 年后"安全团队"长什么样?不是 30 人的 Tier 1 团队——是 5 人的"AI 治理团队"不是"分诊告警的人"——是"训练 AI 分诊的人"不是"24×7 监控"——是"24×7 监督 AI"不是"应急响应"——是"AI 决策的关键决策者"5 年后"安全技能"长什么样?不是"消失",是"升级":不是"会用 Nmap"——是"会训练 AI 用 Nmap"不是"会写 Sigma 规则"——是
Python的学习资源非常丰富,选择适合自己的资源是学习Python的关键。作为一个非科班转码者,我建议大家根据自己的学习目标和水平选择合适的资源,并且保持持续学习的态度。在学习Python的过程中,我深刻体会到实践的重要性。无论选择什么样的学习资源,都要通过实际项目来巩固所学知识,这样才能真正掌握Python编程技能。同时,学习Rust也可以帮助我们从不同的角度理解编程,提高我们的编程能力。通过
目前大模型在长程交互任务中越来越依赖记忆系统。因为大模型本身没有天然的长期状态,如果只依赖上下文窗口,很容易在多轮对话、长期用户偏好建模和跨会话推理中丢失历史信息。记忆系统本身也有成本。例如很多系统需要不断调用大模型总结对话、抽取记忆、更新记忆、解决冲突,这些步骤会引入大量 token 消耗、API 调用和时间延迟。这篇论文提出了一个比较轻量的记忆系统LightMem,目标是在记忆系统的性能和效率
这篇论文不仅用详实的实验击穿了“向量检索是RAG核心”的固有认知,更为轻量化、低成本的大模型知识库落地,提供了一套全新的范式。
上下文管理器是一种可以在进入和退出特定上下文时执行特定操作的对象。它的主要用途是管理资源,如文件、网络连接、数据库连接等,确保这些资源在使用完毕后被正确释放。在Python中,上下文管理器通常与withwith 上下文管理器表达式 as 变量:# 执行操作# 退出上下文,自动执行清理操作# 作为上下文管理器使用# 作为装饰器使用@Timing()Python的上下文管理器是一种强大的工具,它可以帮
GitHub 黑马项目 mattpocock/skills 爆火,核心在于将工程师的开发经验模块化为可复用的“技能(skills)”,推动 Agent 从“提示词工程”迈向“技能工程”。每个 skill 具备清晰输入输出,可组合、嵌套与管理版本,使 AI 不再泛而不精,而是放大工程师能力,实现经验的工程化沉淀与复用。这一思路或将重塑未来 Agent 开发方式。
QuantDash:统一多市场金融数据API平台 QuantDash是一个专为量化研究设计的金融数据API平台,解决了开发者获取稳定、干净、多市场金融数据的痛点。平台提供: 统一RESTful接口覆盖股票、期货、外汇等多市场数据 Python优先的SDK,支持Pandas/NumPy工作流 实时行情与历史K线数据,支持技术指标直接计算 高可用架构,优化实盘与回测场景 用户可通过pip安装SDK,使
这套 Windows 整合一键部署包,核心就是简化 Hermes Agent 的上手门槛,省去从零配置环境的繁琐步骤。整合包已预装全部运行依赖、组件与基础配置,用户仅需完成下载、解压、启动三步操作,就能快速在本地运行 Hermes。对于不熟悉代码与环境配置的新手,它大幅降低了使用难度;对于想要快速测试工具功能、体验本地 AI 能力的使用者,也能有效节省排错与配置时间。如果你想快速体验 Hermes
这两年只要聊大模型应用,RAG几乎是绕不开的话题。最早大家理解RAG,通常是把它看成一个“给大模型外挂知识库”的方案:用户提出问题之后,系统先去知识库里检索相关内容,再把检索结果和用户问题一起塞进Prompt,最后让大模型基于这些材料生成回答。这个理解没有错,但它只解释了最基础的。在很多早期场景里,这套方案已经足够好用。比如产品文档问答、接口说明查询、企业制度检索、FAQ 客服机器人,本质上都是把
Python与Rust的混合编程是一种强大的开发方式,可以结合两者的优势,构建出既高效又高性能的应用。作为一个非科班转码者,我深刻体会到这种混合编程的重要性。我的学习过程并不是一帆风顺的,遇到了很多困难和挫折,但通过不断地实践和学习,我逐渐掌握了Python与Rust混合编程的各种技巧。保持学习,保持输出。虽然现在我还是个菜鸡,但我相信只要坚持,总有一天能成为真正的「第一程序员」!
Python推荐系统实战是一个从基础到应用的过程,需要掌握协同过滤、矩阵分解、深度学习等技术。作为一个非科班转码者,我认为通过系统学习和实践,完全可以掌握推荐系统技术。虽然推荐系统的学习曲线比较陡峭,但通过项目实践和不断积累经验,你会逐渐掌握其精髓。同时,结合Rust的性能优势,可以进一步优化推荐系统的性能。保持学习,保持输出。虽然现在我还是个菜鸡,但我相信只要坚持,总有一天能成为真正的「第一程序
它运行在你自己的服务器上,可以对接 OpenAI、Anthropic、Google Gemini、Ollama 等多家大模型后端,把"AI 聊天"这件事变成一个可自托管、可定制、可扩展的基础设施。可插拔上下文引擎让 OpenClaw 的扩展性上了一个台阶,ACP 持久化绑定让 AI Agent 真正能"入驻"到团队的日常工作流中,而备份系统和安全加固则补上了生产环境部署的重要一环。之前,ACP 的
装饰器是一种特殊的函数,它可以修改其他函数或类的行为。装饰器的语法使用符号,放在被装饰函数或类的定义之前。
这篇文章介绍了一种零门槛入门嵌入式GUI开发的方法,使用LVGL官方Web模拟器配合MicroPython,无需硬件即可学习开发。作者分享了从基础控件到复杂交互的完整学习路径,包括按钮、标签、开关、图表等核心组件的使用方法,并提供了可直接运行的示例代码和常见问题解决方案。通过在线模拟器,开发者可以实时预览界面效果,快速掌握LVGL v9.0的开发技巧,为后续硬件开发打下基础。教程特别适合想入门嵌入
《Agent Harness Engineering:从Demo到产品的驾驭工程》揭示了2026年AI工程领域的关键突破——通过"智能体驾驭工程"(Harness Engineering)解决Agent从概念验证到生产落地的核心挑战。该技术借鉴驯马理念,通过五层架构(约束层、监控层、反馈层、兜底层、评估层)实现AI代理的稳定运行。行业数据显示,采用驾驭工程后,Agent项目落地率提升10倍,典型案
摘要:作者原计划分享Hermes-Agent辩论团队的搭建方案,但因Kimi额度耗尽改用minimax2.7后遭遇严重问题。文章主要控诉minimax智能体的低能表现:无法自主检测运行环境(误判服务器位置),缺乏基本软件识别能力(找不到nodejs和npm),逻辑混乱且推卸责任。作者愤怒指出该模型不仅智商低下,还存在"开摆"的工作态度,在监督机制下仍无法完成基础任务,完全达不到
我们就直奔主题,聊聊怎么用 Python 把你的游戏创意变成现实。Python 在游戏开发领域可能不是 Unity、Unreal 那样的“重型武器”,但它绝对是的轻量化选择,特别适合独立开发者、编程初学者和想快速验证玩法原型的人。要做游戏,先选工具。下面这个表格为你梳理了Python游戏开发中最主流、最实用的三个框架/库,并附上了它们的“定位”和“绝招”,帮你快速决策。接下来,我们以最经典的为例,
摘要:本文探讨了AI Agent在测试开发领域的应用挑战与工程化路径。测试Agent面临需求文档处理、接口变更应对、用例有效性验证、权限控制等问题,导致Demo难以转化为稳定工程流程。文章系统解析了Agent的11个关键工程环节:Token管理、RAG知识检索、Memory机制、Skill封装、ReAct执行验证、MCP工具连接、SDD规格驱动开发、Harness工程环境等,指出测试开发人员应聚焦
我们整理了ContextDB、Memora、MemForest、RMM、MPR、A-MEM、HyMem将对这些项目进行比对,包括核心思想、关键创新、性能数据、适用场景和开源地址等维度。
类似的工具其实早已有之,比如 Amphetamine、Caffeine 等防休眠软件,但它们大多面向的是"插着电源、开着屏幕"的场景。modafinil 的独特之处在于,它专门针对"合盖但不休眠"这个需求,并且允许显示器关闭。不合盖,带着一台亮着屏幕的电脑走来走去,既不方便,也耗电。这个同名的小工具,干的也是让 MacBook "不睡觉"的活儿。这个逻辑在大多数场景下是合理的,但在某些特定场景下,
这篇文章介绍了一个仅用50行Python代码实现的最小化智能Agent系统,不依赖任何框架。核心要点包括: 实现原理:通过ReAct模式(推理-行动-观察循环)构建Agent 核心组件: 工具系统(函数+描述) 结构化提示词(指导LLM按特定格式响应) 消息历史循环(实现多轮交互) 工作流程:LLM解析用户请求→触发工具调用→观察结果→生成最终回答 设计特点:采用简单列表存储消息历史、正则解析工具