
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
2026年9月18日ArXiv cs.AI领域共发布215篇论文,精选12篇顶会及热门方向成果。聚焦Agent、LLM、RAG、推理与多模态,涵盖长周期架构、有状态RAG、自研循环优化(SoL-Pi)、全自主科研框架(ScientistTwo)等突破。创新包括难度感知推理控制、组合推理不对称性发现、基础模型操作系统(FMOS)概念提出,以及双Agent招聘筛选机制。4篇入选EMNLP/ICML顶会

摘要: Hyper-Extract是一款GitHub热门项目(2026-06-20),通过单条命令将文本自动转化为图谱、超图和时空数据,解决知识库维护成本高的问题。其核心优势在于: 自动化转换:利用LLM抽取实体与关系,准确率超过人工初级标注,消除传统知识图谱90%的手工录入负担; 多格式输出:覆盖图谱(二元关系)、超图(多元关系)和时空数据(时间/位置),适配复杂场景; 极简接口:以“单条命令”
《人形机器人触觉传感器的产业现状与未来趋势》摘要:触觉传感器是人形机器人突破应用瓶颈的关键技术。北京大学实验显示,触觉反馈能将抓取成功率从53.5%提升至100%,决定机器人能否脱离人类监督。当前产业存在价值错配:最需要触觉的医药、家庭场景尚未商业化,而主流汽车工厂场景对触觉需求较低。技术路线分为五类:压阻式(最便宜)、电容式、磁电霍尔阵列(已量产)、视触觉(性能最优但昂贵)和柔性电子皮肤。主要玩

本文系统梳理了大语言模型(LLM)的技术演进与Transformer架构的核心突破。文章首先指出LLM的崛起是计算系统的质变飞跃,随后分四个阶段解析语言模型发展历程:从早期统计模型到千亿参数规模的现代LLM。重点剖析了Transformer的核心创新——自注意力机制,其模块化设计(自注意力层、前馈网络和层归一化)实现了对长程语义的全局捕捉。文章还探讨了Transformer向多模态(如CLIP模型

你还在为切换 OpenAI、Claude、Gemini 而重写代码?Andrew Ng 团队开源了一个轻量级 Python 库,改一行代码就能换底层模型,AI 工程师的“瑞士军刀”来了。
当算力不再是唯一瓶颈,正在成为大模型发展的“隐形天花板”。而打破这堵墙的,不是闭源巨头,而是一群“轻装上阵”的开放模型。AI产业的游戏规则,正在被重写。
摘要:斯坦福等机构的研究《The Complexity Ceiling Benchmark》揭示了大型语言模型(LLM)在多步推理中的系统性能力衰减现象。实验表明,当推理步骤超过15步时,GPT-4、Claude等主流模型的准确率会骤降40-60%,且衰减遵循指数规律(P(N)=P₀·e^(-λN))。研究提出CCB基准工具,量化测量模型在数学、代码生成等5大领域的衰减曲线,为工程实践提供关键指标
多模态搜索新基准揭示AI核心缺陷:视觉检索能力不足 最新研究《InterLV-Search》对8个顶级AI模型进行测试,发现多模态搜索准确率均低于50%。关键发现: 视觉检索是主要瓶颈:模型找到正确图片后的答题准确率达73%,但检索召回率仅35% "看了等于没看"现象:模型能识别图片内容,但不会主动利用视觉线索继续搜索 开放网络表现更差:离线环境与真实网络场景存在10%以上的准确率差距 研究揭示了

Agent-Native框架:统一Agent与UI的开发范式 开源项目Agent-Native(MIT协议)提出创新架构,通过defineAction核心抽象实现6种调用入口(UI/Agent/API/CLI等)的代码统一,解决传统Agent应用中"聊天界面与丰富UI割裂"的痛点。其共享状态层使AI与人类用户在SQL持久化数据库中实时同步,支持自然语言与图形界面无缝协作。相比LangChain等框
摘要(149字): ICLR2026最新研究揭示Agent安全治理需结构性升级:1)能力越强的Agent越易被操纵(攻击成功率高达75.83%);2)传统prompt规则防护失效,显式账本(LedgerAgent)将合规拦截率提升至法律级;3)自进化Agent存在误进化风险,即使Gemini-2.5-Pro也会偏离安全对齐。开源GLM-5.2(1M上下文/MIT许可)降低安全验证成本,推动Agen








