logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

实时 3D 数字人落地全记录:SDK 深拆、接大模型、7 个坑、开源工程一键部署

本文介绍了如何利用魔珐星云具身驱动SDK实现"会说话的3D数字人"项目。核心采用"参数流+AI端渲"架构,通过下发音频、表情、动作等多路参数实现本地实时渲染,具有低延迟、轻量化的优势。文章详细解析了speak接口的流式调用、SSML动作控制、事件系统、状态管理、签名鉴权等关键技术点,并重点演示了如何对接大模型实现AI实时对话功能。项目已开源并支持CI/CD一键部署,提供在线体验地址和注册优惠码。

文章图片
#3d#开源
深入理解 Agent Runtime:智能体真正运行起来的核心执行引擎

文章摘要: Agent Runtime 是大模型应用的核心执行系统,负责管理 Agent 任务的完整生命周期,而不仅仅是简单的“LLM + Tool”调用。生产级 Agent 任务可能涉及多工具调用、子任务协调、人工审批、上下文管理等复杂流程,需要 Runtime 提供状态控制、事件处理、错误恢复等能力。 Agent Runtime 的核心是 Run(任务实例),通过状态机(如运行、暂停、完成)和

文章图片
从 Chat UI 到 Agent UI:如何设计一个真正可用的智能体交互界面

文章摘要: 随着AI Agent的发展,传统聊天界面(Chat UI)已无法满足复杂任务需求。本文分析了Chat UI与Agent UI的本质差异:Chat UI围绕消息展开,适合简单问答;而Agent UI需处理持续运行的任务执行过程,涉及计划制定、工具调用、用户确认等多个环节。作者提出Agent UI应围绕"执行过程"设计,采用三栏布局(会话列表、对话执行区、工作区),将聊天沟通与实际成果展示

文章图片
#ui#交互
从 Chat UI 到 Agent UI:如何设计一个真正可用的智能体交互界面

文章摘要: 随着AI Agent的发展,传统聊天界面(Chat UI)已无法满足复杂任务需求。本文分析了Chat UI与Agent UI的本质差异:Chat UI围绕消息展开,适合简单问答;而Agent UI需处理持续运行的任务执行过程,涉及计划制定、工具调用、用户确认等多个环节。作者提出Agent UI应围绕"执行过程"设计,采用三栏布局(会话列表、对话执行区、工作区),将聊天沟通与实际成果展示

文章图片
#ui#交互
Agent 对话中的 SSE 状态恢复:切换页面、重新进入与刷新后如何继续流式输出

本文探讨了AI Agent对话系统中SSE(Server-Sent Events)的设计挑战与解决方案。主要问题在于如何应对用户切换会话、页面刷新、网络中断等场景导致的状态丢失问题。作者提出"快照+事件日志+实时流"的三层架构:通过数据库快照恢复完整状态,事件日志补发断线事件,SSE推送实时更新。文章详细阐述了核心数据对象(会话、消息、执行流、事件)的设计,建议采用结构化事件类型而非简单文本流,并

文章图片
#人工智能#软件工程
Agent 对话中的 SSE 状态恢复:切换页面、重新进入与刷新后如何继续流式输出

本文探讨了AI Agent对话系统中SSE(Server-Sent Events)的设计挑战与解决方案。主要问题在于如何应对用户切换会话、页面刷新、网络中断等场景导致的状态丢失问题。作者提出"快照+事件日志+实时流"的三层架构:通过数据库快照恢复完整状态,事件日志补发断线事件,SSE推送实时更新。文章详细阐述了核心数据对象(会话、消息、执行流、事件)的设计,建议采用结构化事件类型而非简单文本流,并

文章图片
#人工智能#软件工程
Playwright 深度解析:从浏览器自动化到动态爬虫、自动化测试与 AI Agent

Playwright 是一个由微软开发的开源浏览器自动化框架,支持Chromium、Firefox和WebKit三大浏览器引擎,提供多语言接口。它不仅能用于Web自动化测试,还能处理动态网页采集、自动登录、iframe操作等复杂场景。相比传统爬虫工具,Playwright能模拟真实用户操作浏览器,解决JavaScript渲染、动态Token、验证码等问题,适用于现代前端框架构建的网站。尽管资源消耗

文章图片
#自动化#爬虫#运维
大模型输出 JSON 不完整怎么办?从 Prompt 问题到工程稳定性治理

文章摘要:大模型输出JSON不完整是一个常见的工程稳定性问题,表现为语法不完整或内容缺失。原因包括输出长度限制、输入上下文过长、Schema设计复杂等。解决方案需从多层面治理:优先使用结构化输出能力,避免一次性生成大JSON,建立JSON修复机制,设计Schema校验,实施业务完整性检查,并引入重试补偿机制。核心思路是将模型输出视为候选结果,通过工程化流程确保最终JSON的完整性和准确性,而非单纯

文章图片
#json#java
Git Worktree 终极指南:解锁多 AI 并行开发的“影分身”之术

摘要:本文介绍如何利用Git Worktree实现多AI并行开发,解决传统Git流程中频繁切换分支和代码冲突的问题。通过抖音视频提取工具案例,演示了如何为不同AI任务创建独立工作目录(Worktree)和分支,实现物理隔离开发。关键优势包括:真并行开发能力、毫秒级上下文切换、环境隔离等。文章还提供了具体操作步骤、避坑指南和最佳实践,如命名规范、依赖管理注意事项等。这种"Human-in-

文章图片
#git#人工智能#架构 +1
Responses API——OpenAI 下一代智能体与多模态 API 完整开发者指南

OpenAI发布新一代Responses API,标志着AI开发从传统聊天模式转向智能体优先的新时代。该API整合了GPT-5推理、多模态支持、结构化输出和函数调用等核心功能,采用全新的请求架构和状态管理机制。开发者可通过reasoning.effort和text.verbosity等参数精细控制模型行为,并利用内置工具和结构化输出构建复杂工作流。本文详细解析了新旧API差异、状态链管理、推理参数

文章图片
#人工智能#架构
    共 166 条
  • 1
  • 2
  • 3
  • 17
  • 请选择