logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

AI开发者工具的双子星:Cursor与ChatGPT Canvas的区别

探讨Cursor与ChatGPT Canvas在AI辅助开发中的核心差异,揭示各自的优势与定位。

文章图片
大模型评估避坑指南:从预训练到Agent的全链路评估框架

本文系统阐述大模型全生命周期评估方法,覆盖预训练、SFT、RLHF、数据集、RAG、Agent、Prompt七大维度,提供可落地的评估指标体系和实操方案,帮助企业在AI落地过程中避开常见陷阱。

文章图片
普通CPU运行70亿参数大模型:零GPU与API困境下如何开发AI Agent

面对无GPU资源、禁用外部API的严苛条件,本文通过llama.cpp开源项目实现70亿参数大模型在普通CPU环境的高效运行。从量化技术原理到实战部署,详解如何突破硬件限制,为资源受限团队提供可复用的落地方案。

文章图片
#AI智能体#GPU
Qwen3-VL:开源视觉大模型新标杆,数学推理与Agent能力全面碾压Gemini 2.5 Pro

阿里开源Qwen3-VL系列重塑多模态AI格局,旗舰模型Qwen3-VL-235B-A22B在46项评测中32项超越Gemini 2.5 Pro与GPT-5,数学推理、视觉Agent能力实现质的飞跃。本文深度解析其空间理解突破、长视频处理黑科技及真实落地场景,手把手教你用开源模型打造智能代理应用。开发者速抢免费API接口,开启AI认知革命!

文章图片
#AI#多模态
AI落地的“冰与火之歌”:从Anthropic报告看企业大模型的真实战场

AI正以史无前例的速度席卷全球,但落地之路远非坦途。Anthropic最新报告揭示:企业应用高度集中于自动化编程,90%公司尚未真正用上AI;用户行为从“聊天”转向“下命令”;全球使用严重失衡,富裕国家独享红利。更关键的是,“上下文约束”成为最大瓶颈——不是模型不够强,而是企业喂不饱它。本文深度拆解这份报告,告诉你大模型落地的真实图景、核心卡点与破局之道。

文章图片
#人工智能#深度学习
别再瞎调大模型了!LLM微调九种姿势全拆解,哪招最适合你?

大模型微调不是“全参开干”就完事。从LoRA到BitFit,从Adapter到Prefix-Tuning,九种主流方法各有千秋。本文一次性讲清每种技术的原理、适用场景与资源代价,帮你避开“调了等于没调”的坑,精准选对落地策略。

文章图片
#算法#人工智能
SpringCloud API Gateway2.0如何解决docker中应用间IP漂移的正确手法

spring cloud api gateway2.0不仅可以做流控、请求拦截,其实它最最重要的一个特性是可以和nacos结合并解决docker容器内应用的ip漂移的问题,这是全网不曾有过任何介绍的。本文还详细介绍了如何构建一个本地的docker镜像仓库的详细步骤,为不可多得的云原生微服务系列教材之一。

文章图片
#spring cloud#docker#云原生
一图看透大模型“性格开关”:Top-k、Top-p 与温度如何联手控制AI的“嘴”

你有没有想过,为什么同一个大模型有时写诗如李白,有时却像小学生造句?秘密就藏在三个“性格开关”里:Top-k、Top-p 和温度。本文用一张图+万字详解,带你从原理到实战,彻底搞懂它们如何联手决定AI是“稳如老狗”还是“放飞自我”。

文章图片
#人工智能#机器学习#AI +2
EmbeddingGemma:把大模型“塞进”你手机的嵌入神器,本地跑得快、隐私保得住、效果还不差

Google最新开源的EmbeddingGemma,仅3亿参数却性能炸裂,内存占用不到200MB,支持100+语言,还能在手机上本地运行!本文深度拆解它的技术原理、实战用法、微调技巧与企业落地场景,手把手教你如何用它构建隐私安全、低延迟、高精度的RAG、语义搜索和代码检索系统。

文章图片
#人工智能#RAG
大模型幻觉:AI的“创造性谎言”与技术边界的博弈

大模型幻觉如同AI的“创造性谎言”,根植于语言离散性与机器学习连续性的根本矛盾。本文深入剖析幻觉产生机理,探讨RAG、微调等缓解策略的有效性与局限性,为企业落地大模型提供实用指南。

文章图片
#人工智能#机器学习
    共 559 条
  • 1
  • 2
  • 3
  • 56
  • 请选择