logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

Codex 实践系列 Vol.05:长任务里的事实、边界和验收

用真实项目看看,给 Codex 立哪些规矩才真正有用。

文章图片
#人工智能#数据库#github
Codex 实践系列 Vol.05:长任务里的事实、边界和验收

用真实项目看看,给 Codex 立哪些规矩才真正有用。

文章图片
#人工智能#数据库#github
OpenAI 要从 Cursor 撤模型,腾讯开源 Hy4,索尼、华纳起诉 Anthropic

本周AI圈密集更新:腾讯Hy4预览版、Qwen3.8-Flash-Next(Qwen4架构先行版)、智谱GLM-5.3-Flash、阿里Wan3.0(单次生成30秒视频)及微信WeMM多模态Embedding模型集中发布;Hugging Face开源小鸭机器人Microduck,英伟达拟129亿美元收购HF;OpenAI终止向Cursor供模型。

文章图片
#开源#java#github +3
旧手机如何组建集群,跑点云计算?

UC San Diego 与 Google 合作推进“手机集群计算”:拆解退役手机主板,组建低碳小型计算集群。首期将部署 2000 台 Pixel 手机主板,替代传统服务器,为教学科研提供低成本云资源,兼顾环保与算力复用。

文章图片
#云计算
端侧 AI 的推理加速:手机端大模型怎么提速?

Google 给 Pixel 上的 Gemini Nano 装了个“先猜后验”的加速器

文章图片
#人工智能#语言模型
LLM 如何批量且精准地实现电商海量标签标注与验证?拆解 Amazon 的 SynthAVE 工业级多模型质检方案

Amazon提出SynthAVE方案,用7个LLM+3类Prompt构建21种评审配置,通过多数投票形成机器共识,仅对原始标签与共识冲突的样本触发人工复核,在可控成本下将电商合成标签准确率从92.6%提升至95.0%,破解大规模标签质检瓶颈。

文章图片
#前端#MCP
Dockerless:不跑测试、不搭环境,也能给 Coding Agent 的修复打分?

上海交大与抖音团队提出Dockerless:首个无需执行环境的代码修复验证器。它摒弃传统Docker测试,让Verifier像人类审阅者一样主动探索代码库、搜集证据并裁决patch有效性,在SWE-bench等基准上AUC达81.0,显著提升SFT/RL训练效率与泛化性。

文章图片
#人工智能#前端
实测推荐 3 个 Skill,轻松上手 Codex 网页设计与交付流程

小七实测3个前端Skill:`design-taste-frontend`强化设计规范与双主题支持,`humanizer`去除AI腔、优化文案自然度,`better-interface`完成可访问性等交付级审查。结果表明——当Agent基础能力已强,Skill核心价值转向固化专业标准、流程与质量门禁。

文章图片
#人工智能#前端#java +2
实测推荐 3 个 Skill,轻松上手 Codex 网页设计与交付流程

小七实测3个前端Skill:`design-taste-frontend`强化设计规范与双主题支持,`humanizer`去除AI腔、优化文案自然度,`better-interface`完成可访问性等交付级审查。结果表明——当Agent基础能力已强,Skill核心价值转向固化专业标准、流程与质量门禁。

文章图片
#人工智能#前端#java +2
拆解 dsh 系列:从源码和版本变化看 DeepSeek Harness 的设计取舍

DeepSeek Harness(dsh)发布仅两周,实则历经两个月内部打磨。本文基于Git历史与npm发布数据,梳理其从0.0.1-rc.1到0.1.1-rc.2的演进:命名重构、定位升维(Coding Agent→Agent Harness)、核心与扩展边界持续厘清,展现一个开源智能体运行时如何审慎定义自身能力疆界。

文章图片
#spring#java#后端 +2
    共 153 条
  • 1
  • 2
  • 3
  • 16
  • 请选择