logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

【2026热评】Hermes Agent 一周暴涨五万 Star,AI Agent 框架疲劳时代该怎么选?

给在 AI Agent 热浪里刷 GitHub Trending 刷到焦虑的开发者:这篇不评测 Hermes,而是聊一个更值得你花时间的问题——追工具还是建体系。

文章图片
#人工智能
国内AI编程IDE对比(二):从零构建桌面应用实测

在上一篇对比中,我们从直观感受和技术架构角度审视了几大AI编程IDE。但说实话,那些都只是表面功夫——真正的考验在于实战能力。作为一名在视频技术、后端架构领域深耕十余年的开发者,我深知:再炫酷的功能,不如能跑起来的代码。所以今天,我要来点硬核的——让这三大AI IDE从零开始构建一个完整的C++桌面录屏程序。

文章图片
#ide
国内AI编程IDE对比(三)Skill生成能力测试

国产AI编程工具Skill能力对比:CodeBuddy与Trae在短视频生成Agent任务中的表现 本文对比了两款国产AI编程工具CodeBuddy和Trae在开发"短视频生成Agent"任务中的表现。测试任务包含创意策划、视觉设计、素材生产和视频合成四个环节。CodeBuddy以极速完成著称,5分钟内生成代码,但存在结构简单、提示词硬编码、风格失控等问题。Trae则展现出更好

文章图片
#人工智能
Codex 5.3 与 Opus 4.6 同日升级,AI 编码竞争从“会写”转向“能闭环”

2026真的是 AI Agent 爆发的一年。OpenAI 与 Anthropic 几乎前后脚发布新版本:`GPT-5.3-Codex` 与 `Claude Opus 4.6`。再叠加国内大模型在 1月到2月的密集动作,现在看来,智能体的发展速度,已经超出大多数人的预料了,我们都需要紧跟脚步。

文章图片
#人工智能
【2026深度解析】AI Agent 浏览器自动化六大技术路线对比——从 Playwright 到 Chrome 扩展注入

本文系统对比了 AI Agent 场景下六种浏览器自动化方案——模拟点击(Playwright/Selenium)、截图+AI视觉、CDP 直连、Chrome 扩展注入、纯 HTTP 请求、API 代理。从反爬检测能力、执行速度、登录态管理三个核心维度分析各方案的技术原理与局限。结论:前三种方案本质都是"伪装",在 AI 行为分析时代已难以持续;Chrome 扩展注入通过复用真实浏览器会话,从根本

文章图片
#人工智能
社交的“诺曼底登陆”:深度解析腾讯元宝“元宝派”的技术逻辑与场景重构

1 月 26 日,腾讯 AI 助手“元宝”正式开启了名为**“元宝派”**的全新功能。如果说此前的元宝还是一个主打效率的 Chatbot,那么“元宝派”的出现,标志着腾讯正式将其核心护城河——**社交关系链**,深度融入了生成式 AI。今天我们从技术架构、社交逻辑和生态位三个维度,拆解一下这个被称为“AI 社交空间”的新物种。

文章图片
#重构
【2026热评】Hermes Agent 一周暴涨五万 Star,AI Agent 框架疲劳时代该怎么选?

给在 AI Agent 热浪里刷 GitHub Trending 刷到焦虑的开发者:这篇不评测 Hermes,而是聊一个更值得你花时间的问题——追工具还是建体系。

文章图片
#人工智能
国内四大AI编程IDE对比(二):从零构建桌面应用实测(补上Trae,幸亏补上了)

本文对百度Comate、阿里通义灵码和腾讯CodeBuddy三大国产AI编程IDE进行了C++桌面录屏程序的实战测试。测试结果显示,三者均未能成功生成可运行程序:百度Comate陷入编译死循环,阿里通义灵码出现AI幻觉,腾讯CodeBuddy虽表现最佳但仍无法解决MFC初始化问题。测试暴露了当前AI编程IDE在复杂项目构建、错误诊断和资源管理方面的明显不足,表明国产AI编程工具距离真正实用化还有较

文章图片
#ide
Google正式上线Gemini In Chrome,国内环境怎样开启。

谷歌将Gemini AI集成到Chrome浏览器中,与OpenAI的Atlas展开竞争。Gemini以侧边栏形式提供网页内容总结、图像识别和生成等功能,支持多平台。但目前仅限美国用户使用,且存在隐私和稳定性问题。非美国用户可通过修改配置文件启用该功能。AI助手竞争正从模型性能转向入口覆盖,浏览器正成为重要AI入口。这一趋势为用户提供了更多工具选择。

文章图片
#chrome#前端
我让 Claude 和 Codex 同时审计 26 个模块,它们只在 10 个上达成共识

SWE-bench Verified 排行榜上,Claude Opus 4.6 拿了 80.8%。OpenAI 直接不交卷了——他们认为这个榜单存在训练数据污染,分数已经不能反映真实能力。有意思。两家最强的编程 AI,一个考了高分,一个拒绝参考。那我换个考法:让它们干同一件活——审计我手里这个十几年的 C++ 遗产项目——看看实战结果差多少。注:截图中 Agent-2 显示为 “o4-mini”

文章图片
#人工智能#重构#c++ +1
    共 35 条
  • 1
  • 2
  • 3
  • 4
  • 请选择