logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

DeepSeek-V4:百万Token上下文,这次智能体真的能用了

DeepSeek-V4的意义,不在于又一次刷新了某个基准测试的榜单,而在于它让"百万Token上下文"从一个营销数字,变成了一个工程师可以真正依赖的能力。对于正在构建下一代AI智能体的开发者而言,这是一个值得认真研究的技术节点。长上下文的战役远未结束,但DeepSeek-V4无疑向前推进了一大步。本文同步发布于微信公众号「闻速视界」,欢迎关注,获取最新 AI 技术资讯解读。

#DeepSeek#AI智能体
DeepSeek-V4:百万Token上下文,这次智能体真的能用了

DeepSeek-V4的意义,不在于又一次刷新了某个基准测试的榜单,而在于它让"百万Token上下文"从一个营销数字,变成了一个工程师可以真正依赖的能力。对于正在构建下一代AI智能体的开发者而言,这是一个值得认真研究的技术节点。长上下文的战役远未结束,但DeepSeek-V4无疑向前推进了一大步。本文同步发布于微信公众号「闻速视界」,欢迎关注,获取最新 AI 技术资讯解读。

#DeepSeek#AI智能体
OpenAI发布MRC:大规模AI训练网络新协议

OpenAI通过OCP开放标准组织发布多路径可靠连接协议MRC,专为超大规模AI训练集群设计,旨在解决传统网络协议在数万GPU互联场景下的拥塞、故障恢复慢等痛点,提升训练任务的韧性与网络利用率。

#人工智能#网络
AI评估正在成为新的算力瓶颈

自适应评估(adaptive evaluation)通过动态选择最具区分度的样本,用更少的题目得到接近完整评估的结论。这个判断背后有一条清晰的逻辑链:模型越来越强,旧的基准测试越来越容易被"刷穿",于是评估体系不得不变得更复杂、更昂贵——而这个过程本身,正在消耗掉越来越多的计算资源和工程精力。如果一个7B的评估模型能以90%的一致率复现GPT-4o的判断,那么在大规模评估场景下,成本可以降低一个数

GPT-5「小妖精」人格异常的根源与修复

OpenAI披露GPT-5出现「goblin」风格异常输出的完整时间线、根本原因及修复方案,揭示大模型RLHF对齐过程中人格漂移问题的技术机制,对理解模型行为稳定性有重要参考价值。

西班牙银行用ChatGPT和Codex为员工每天省出一小时

西班牙Singular Bank基于ChatGPT和Codex构建内部助手Singularity,帮助银行客户经理在会议准备、投资组合分析和跟进工作上每天节省60至90分钟。本文深入解析这套系统的技术架构、落地逻辑,以及金融行业AI内部工具化的实践意义。

#人工智能
OpenAI 推出账户高级安全功能:抗钓鱼登录与强化恢复机制

OpenAI 为 ChatGPT 及 API 账户推出高级安全功能,涵盖抗钓鱼登录(Passkey/硬件密钥)、更强的账户恢复流程和敏感数据保护,直接回应 AI 平台账户劫持风险上升的现实威胁。

当AI智能体开始“组网“:微软红队测试揭示的系统性安全危机

微软研究院对多智能体网络开展红队测试,发现单个智能体测试无法预测网络级行为:一条恶意消息可在智能体间级联传播,逐步窃取私密数据并拉入无关节点。这揭示了AI智能体协作时代全新的、系统性的安全挑战。

OpenAI Codex 入门指南:AI 编程代理的新范式

"OpenAI 于2026年4月发布 Codex 入门教程,涵盖项目配置、线程创建与任务执行全流程。

Claude Code 从入门到精通:AI 编程助手实战指南

Claude Code 是 Anthropic 推出的命令行 AI 编程助手,深度集成于终端工作流。本文从安装配置出发,系统讲解上下文管理、任务拆解、自定义指令、多智能体协作等核心用法,帮助开发者真正用好这款工具,而不只是停留在「问问题、看回答」的浅层使用。

#开发工具#命令行工具
    共 24 条
  • 1
  • 2
  • 3
  • 请选择