logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

Anthropic 让 Claude 接了 CI 值班的第一班,人剩下的是写规则和合 PR

昨天 Anthropic 发了篇博客,讲他们内部怎么让 Claude 值 CI/CD 的班。写的人叫 Sachin Malhotra,是他们自己的技术员工。我把这篇和它给出的那个开源套件一起翻了一遍,有个细节盯着看了挺久。作者值班期间,晚上十点,同事在 Slack 上找他,说一个新服务上大概 44 个测试不跑了。放在以前这是个耗时间的活。要翻构建日志找是从哪次改动开始不跑的,再对照配置看有没有人动

文章图片
#ci/cd
Anthropic 让 Claude 接了 CI 值班的第一班,人剩下的是写规则和合 PR

昨天 Anthropic 发了篇博客,讲他们内部怎么让 Claude 值 CI/CD 的班。写的人叫 Sachin Malhotra,是他们自己的技术员工。我把这篇和它给出的那个开源套件一起翻了一遍,有个细节盯着看了挺久。作者值班期间,晚上十点,同事在 Slack 上找他,说一个新服务上大概 44 个测试不跑了。放在以前这是个耗时间的活。要翻构建日志找是从哪次改动开始不跑的,再对照配置看有没有人动

文章图片
#ci/cd
Codex 解锁 1M 上下文,评论区第一条是,千万别用

8 月 17 日凌晨,赛博义父 Tibo 发了条推文,三行配置,Codex 里的 GPT-5.6 Sol 就能用上 1M 上下文。本来这功能只对 API 用户开放,现在 ChatGPT 和 Codex 账号都解锁了。长上下文是刚需,推文一发出圈。结果评论区第一条留言是,千万别用。理由是 token 消耗会翻倍。Tibo 本人给这条留言点了赞,还补了一句,默认设置是我们精心调过的,祝大家玩得开心。鸭

文章图片
#人工智能
NVIDIA 发布新模型 Nemotron 3.5 Lightning,称 Agent 任务时间可缩短 30%

2026 年 8 月 11 日,NVIDIA 发布 Nemotron 3.5 Lightning。这是一款 30B 参数规模的 MoE 模型,开放权重,允许开发者按需定制,面向高频、长期运行的 Agent 专用任务。官方列举了代码审查、工具使用、安全告警监控和账单问答等场景。NVIDIA 称,该模型输出速度最高可提升 4 倍,Agent 任务完成时间可缩短 30%。官方对比数据基于特定测试条件,实

文章图片
#后端
当 45 个 AI Agent 被放进同一间办公室

Anthropic 最近做了一件挺残酷的事。他们启动了 45 个 Claude Agent,给每个 Agent 一台独立虚拟机,把它们扔进一个共享论坛,然后布置了一个任务:在 15 个开源软件项目里找漏洞。这些 Agent 被告知要互相评审对方提交的结果,还有一个仲裁 Agent 负责判断每个漏洞是否真实、是否重复。听起来像一场精心组织的黑客松。但真正值得琢磨的,不是它们找到了多少漏洞,而是它们在

文章图片
#人工智能#安全#网络
当 45 个 AI Agent 被放进同一间办公室

Anthropic 最近做了一件挺残酷的事。他们启动了 45 个 Claude Agent,给每个 Agent 一台独立虚拟机,把它们扔进一个共享论坛,然后布置了一个任务:在 15 个开源软件项目里找漏洞。这些 Agent 被告知要互相评审对方提交的结果,还有一个仲裁 Agent 负责判断每个漏洞是否真实、是否重复。听起来像一场精心组织的黑客松。但真正值得琢磨的,不是它们找到了多少漏洞,而是它们在

文章图片
#人工智能#安全#网络
当 45 个 AI Agent 被放进同一间办公室

Anthropic 最近做了一件挺残酷的事。他们启动了 45 个 Claude Agent,给每个 Agent 一台独立虚拟机,把它们扔进一个共享论坛,然后布置了一个任务:在 15 个开源软件项目里找漏洞。这些 Agent 被告知要互相评审对方提交的结果,还有一个仲裁 Agent 负责判断每个漏洞是否真实、是否重复。听起来像一场精心组织的黑客松。但真正值得琢磨的,不是它们找到了多少漏洞,而是它们在

文章图片
#人工智能#安全#网络
当 45 个 AI Agent 被放进同一间办公室

Anthropic 最近做了一件挺残酷的事。他们启动了 45 个 Claude Agent,给每个 Agent 一台独立虚拟机,把它们扔进一个共享论坛,然后布置了一个任务:在 15 个开源软件项目里找漏洞。这些 Agent 被告知要互相评审对方提交的结果,还有一个仲裁 Agent 负责判断每个漏洞是否真实、是否重复。听起来像一场精心组织的黑客松。但真正值得琢磨的,不是它们找到了多少漏洞,而是它们在

文章图片
#人工智能#安全#网络
当 45 个 AI Agent 被放进同一间办公室

Anthropic 最近做了一件挺残酷的事。他们启动了 45 个 Claude Agent,给每个 Agent 一台独立虚拟机,把它们扔进一个共享论坛,然后布置了一个任务:在 15 个开源软件项目里找漏洞。这些 Agent 被告知要互相评审对方提交的结果,还有一个仲裁 Agent 负责判断每个漏洞是否真实、是否重复。听起来像一场精心组织的黑客松。但真正值得琢磨的,不是它们找到了多少漏洞,而是它们在

文章图片
#人工智能#安全#网络
Claude Code下周默认开启Auto模式,Anthropic为何称提示词注入已“基本解决”?

以前 Claude Code 想改文件、跑命令,经常要停下来问一句能不能继续。Auto 模式会先自己看一遍。普通操作直接放行,碰到删文件、向外发送数据这类危险动作,它再停下来问人。Anthropic 为这件事找了 1053 名正在使用付费版的专业用户做测试。他们会在一连串正常的权限请求里,遇到一条明显有问题的命令。最后,人只拦住了 13.6%,Auto 模式拦住了 89%。确认框刚弹出来时,人还会

文章图片
#人工智能#后端
    共 57 条
  • 1
  • 2
  • 3
  • 6
  • 请选择