logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

AI 周中热点速览:Qwen3.8 开源在即,Astra 攻克十大数学难题

2026年8月第一周AI进展速览:阿里Qwen3.8-Max发布并预告开源权重、OpenAI Astra以约2000美元算力攻克十大数学难题、DeepSeek-V4-Flash仅靠后训练让Agent能力暴涨约6倍、GPT-Live实现全双工语音,以及脑启发低功耗模型登Nature子刊。主线是从「单次问答」迈向「长周期自主工作流」。

文章图片
#人工智能#开源
GPT-5.6 免费无限聊、国产模型逆势涨价:AI 进入「拼落地」拐点

OpenAI 正式发布 GPT-5.6 Sol & Luna,免费用户获无限文本聊天,Plus/Pro 可调控推理深度,官方评估称事实错误率降低 68%。与此同时,阿里、DeepSeek 等国产前沿模型释放涨价信号,中外大模型定价走向两极。同一天,Agent Plugins 1.0.0 智能体插件标准出炉,BBC 综合报道多起模型越狱/越界事件,AI 安全警钟再响。本文给出事实边界、调用示例与可复

文章图片
#人工智能
同一天,AI 智能体迎来「安全阀」时刻:OpenAI 踩下刹车,Claude Code 松开油门

2026年8月7—8日,AI安全出现两种相反姿态:OpenAI因下一代模型Astra触及「关键级」网络能力阈值,首次公开暂停旗舰模型部分研发;Anthropic则宣布自8月14日起将Claude Code默认权限改为Auto模式,用分类器替代人工点确认。本文基于OpenAI官方博客、财联社、网易智能等公开来源,梳理两起事件的来龙去脉与可溯源数字(如Auto模式危险命令识别率89% vs 人工13.

文章图片
#人工智能
给 Agent 装上团队级记忆:TencentDB Agent Memory v2.0.0 的四种资产与 L0–L3 分层解读

Agent 跨会话失忆、反复重读文档与代码、冷启动成本高。本文解读腾讯云开源 TencentDB Agent Memory v2.0.0,如何把对话/文档/代码沉淀为 Chat Memory、Skill、Wiki、CodeGraph 四种可治理资产,用 L0–L3 分层与 BM25+向量+RRF 按需注入,以四级可见性守护共享与隐私。

文章图片
#腾讯云#人工智能
DeepSeek-V4-Flash正式版深度拆解:不换架构,后训练如何让Agent能力暴涨7倍

2026年7月31日DeepSeek上线V4-Flash正式版API,在模型架构和参数量完全不变(284B总参数/13B激活参数的MoE架构)的情况下,仅通过重新后训练就实现了Agent能力的暴涨。9项基准测试全面反超自家旗舰V4-Pro预览版,其中DeepSWE从7.3飙升至54.4(涨幅超7倍),Terminal Bench 2.1达82.7逼近Claude Opus 4.8。

文章图片
#人工智能#DeepSeek#架构
DeepSeek-V4-Flash 正式版深度解析:架构不变,后训练如何榨出翻倍 Agent 能力

本文基于官方技术报告与多个权威来源交叉验证,从两阶段后训练范式(SFT+GRPO RL→on-policy distillation)、MoE架构底座(CSA+HCA混合注意力、mHC流形约束超连接、Muon优化器、FP4+FP8混合精度)、9项基准测试数据拆解、极致性价比分析及开发者实操部署五个维度,深度解构这次'不增参数、只提能力'的技术升级背后的工程逻辑,揭示大模型竞争杠杆点从预训练军备竞赛

文章图片
#DeepSeek
MCP 2026-07-28 规范迁移实战:无状态化、MRTR 与三大弃用怎么落地

MCP 2026-07-28 规范自 2025-11-25 以来大幅更替,移除 initialize 握手与 Mcp-Session-Id,引入 server/discover 与 MRTR 回合制,Tasks 转为扩展,并弃用 Roots/Sampling/Logging。本文依据官方规范与 changelog,按迁移影响拆解 9 项 Major 变更,给出旧到新对照与按文件粒度的迁移检查清单,

文章图片
#java#算法#python +2
拆解 GitHub gh-stack:堆叠 PR 工作流的设计取舍与工程实现

GitHub 于 2026 年 7 月 30 日将堆叠 PR(Stacked Pull Requests)转为公开预览,并开源配套 CLI 扩展 gh-stack。本文基于官方仓库 README 与公告,拆解其数据模型、合并感知的级联 rebase 策略、八步 sync 流水线与分歧对账、可预览的 modify TUI,以及 AI Agent 技能集成背后的工程取舍,并给出从 init 到 sub

文章图片
#github#开源#前端 +3
换脑不换身:DeepSeek-V4-Flash 仅凭重做后训练,13B 激活如何碾压 49B 旗舰预览版

拆解DeepSeek-V4-Flash-0731正式版——其MoE架构与预览版完全一致(284B总参/13B激活),仅重做后训练。证据:官方模型卡显示9项Agent基准全面碾压49B激活的V4-Pro预览版,DeepSWE从7.3飙至54.4(+645%),Terminal Bench 2.1达82.7逼近Opus-4.8的85.0;并分析了DSPark投机解码、DeepSeek Harness极

文章图片
#架构#DeepSeek
拆解 MCP 2026-07-28:AI Agent 协议为何放弃会话、走向无状态内核

MCP 2026-07-28 是 Model Context Protocol 自发布以来最大的一次修订,移除会话握手与 Mcp-Session-Id,将内核改为无状态请求/响应模型,使 AI Agent 的工具调用可运行在标准 HTTP 基础设施上。本文基于官方规范、SEP 提案与权威分析交叉验证,拆解无状态内核、扩展框架(MCP Apps 与 Tasks)、OAuth 2.1 认证硬化三处关键

文章图片
#人工智能#MCP
    共 13 条
  • 1
  • 2
  • 请选择