
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
本文摘要:文章介绍了语音交互技术的演进历程和发展现状,从早期的语音识别系统到现代智能语音助手的普及。重点探讨了Web Speech API等核心技术,通过完整代码示例展示了如何在浏览器中实现基础语音识别功能,包括初始化、参数配置和事件处理。文章指出,随着技术成熟和用户习惯形成,语音交互正成为前端开发的重要方向,为各类应用场景创造价值,同时提升数字可访问性。

本文介绍MyBatis-Plus作为MyBatis的无侵入增强工具,阐述其自动注入CURD、Lambda支持、主键自动生成、内置分页与代码生成器等核心特性,以及支持多种数据库的能力。文章通过Spring Boot快速入门示例,演示依赖引入、数据源配置、建表、实体类开发及Mapper继承BaseMapper实现通用CRUD的完整流程,并说明@TableName表映射与@TableId主键配置等常用注

上篇把 Django 镜像从 2GB 瘦身到 180MB。下篇用 `docker-compose.yml` 把 Django、MySQL、Redis、Nginx 四个服务编排在一起——一个 `docker-compose up -d` 就全跑起来。重点讲:服务之间的依赖顺序控制(`depends_on` + `healthcheck`)、数据库数据持久化(`volumes`)、静态文件和白卷代理(

把 Django 项目 Docker 化的第一步——写 Dockerfile。但大多数人第一次构建出来的镜像都在 800MB-1.2GB 之间。原因很简单:基础镜像选了 `python:3.11` 而不是 `python:3.11-slim`,构建依赖和运行依赖混在一起,`pip install` 的缓存文件没清理。上篇聚焦 Dockerfile 的优化——从单阶段构建到多阶段构建、从 `pip

本文手把手教你用一套Python代码同时调用通义千问(Qwen)、文心一言(ERNIE)、DeepSeek和GLM四大国产大模型。内容包括各厂商API的注册与Key获取、OpenAI兼容接口的统一封装技巧、不同模型在代码生成/中文理解/成本控制三个维度的实测对比,以及一个多模型热切换的通用客户端实现。文末附有各模型定价对比表与选型决策树Mermaid图,适合想在国内模型之间灵活切换的AI应用开发者

本文是AI大模型入门系列的实战终章——用Streamlit框架30分钟搭建一个完整的AI聊天网页应用。内容涵盖Streamlit环境搭建与核心组件、会话状态管理与多轮对话、Markdown渲染与流式输出集成、以及一键部署到Streamlit Cloud公网访问的完整链路。文末有Mermaid架构图展示前后端交互全流程,适合学完前面API调用知识、想快速做出一个可展示的AI产品的开发者。

本文深入讲解RAG系统中一项高级检索技术——Self-Querying(自查询检索)。传统检索只做语义匹配,而Self-Querying让LLM先理解用户意图、自动提取查询中的结构化过滤条件(时间、类别、作者等元数据),再与语义向量检索联合执行。文中拆解了LangChain的SelfQueryRetriever完整工作流程,包含Mermaid时序图、自定义元数据字段的Schema定义、以及一个"个

本文是微调板块的开篇,系统回答"什么时候该用Prompt、什么时候该上RAG、什么时候必须微调"这个所有AI开发者都会遇到的选型难题。文章从成本(开发成本+运行成本)、效果天花板、数据量要求三个维度,对比四种主流方案:纯Prompt工程、Few-Shot Prompt、RAG检索增强、SFT微调,并给出真实的业务场景对照表和混合使用的架构图(RAG负责知识+微调负责风格)。配有Mermaid决策树

本文系统讲解大模型推理服务的可观测性建设,解决"服务上线后变成黑盒,出问题靠用户投诉才发现"的运维盲区。文章从AI服务与传统Web服务的监控差异切入——除了延迟和错误率,Token生成速度、KV Cache水位、队列长度这些AI特有指标才是健康的晴雨表;随后给出完整的指标体系设计:五类核心指标(延迟分布TTFT/TPOT、吞吐Token生成速度、容量KV Cache使用率/GPU利用率、稳定性错误

本文系统讲解大模型在边缘设备上的部署方案,把"跑AI"的战场从服务器机房拉到树莓派和手机。文章从端侧推理的三个独特价值切入——数据不出设备的绝对隐私、无网络环境下的可用性、零API成本的离线服务;随后直面硬件现实:树莓派4GB内存、手机8GB,能跑的模型被严格限定在1B~3B档位(TinyLLaMA、Qwen2-1.5B、Phi-mini等微型模型清单与能力边界);详解三大落地方案:llama.c








