logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

最全本地部署 DeepSeek R1 教程(适用于 Mac、Windows、Linux)

DeepSeek R1 是一款开源 AI 模型,性能媲美 GPT-4 和 Claude 3.5 Sonnet,在数学、编程和推理任务上表现优异。它提供多个参数版本(1.5B-70B),支持本地离线运行,确保数据隐私和零成本使用。通过 Ollama 工具可轻松安装,搭配 Chatbox 实现图形界面交互。硬件要求从 8GB 内存(1.5B 版)到 64GB+(70B 版)不等。安装后可用于代码生成等

#macos#windows#linux +2
AI大模型从训练到推理,对应的硬件也将从HBM转向SSD

大模型发展分为三个阶段:1)通用大模型竞争趋于稳定,预计2027年前将形成国内外各3家头部企业格局;2)大模型训练需求将转向细分领域,HBM需求增速将放缓;3)大模型推理阶段成为重点,CPU+SSD组合将迎来爆发式增长,预计AI基建投资将持续到2030年。文章指出推理能力决定商业化成败,存储设备(特别是SSD)将成为未来投资重点,并附赠包括学习路线图、视频教程、技术文档等价值2万元的AI大模型学习

#人工智能#语言模型#python
这大概是我读过关于AI大模型最全面、好读又易懂的文章了

本文以神经网络为核心,探讨其在AI大模型中的基础作用。神经网络虽名含“神经”与“网络”,实则与生物学关联有限,其分层结构(输入层、隐藏层、输出层)和单向信号传递(正向传播)模拟了大脑神经元的单向信息处理逻辑。作者通过类比网络通信中的分层架构,解析神经网络中线性与非线性关系的差异,强调激活函数对非线性建模的关键作用。文章还提及GPU对大模型训练的支撑,以及Agent作为普通用户接触大模型的常见方式。

#人工智能#语言模型#python
2026年国内外最新AI大模型汇总(含搜索模型)

本文对2026年国内外主流AI大模型进行了对比分析。国外方面,OpenAI的ChatGPT具备强大的语言生成能力但存在事实准确性不足的问题;Anthropic的Claude强调安全可控,推理能力突出;Google的Gemini深度整合多模态功能但开放度有限。国内方面,百度的文心一言中文处理能力优异,科大讯飞的星火则在语音交互领域表现突出。总体来看,各大模型在性能、应用场景和商业化程度上各具特色,反

#人工智能#语言模型#python
2026年国内外最新AI大模型汇总(含搜索模型)

本文对2026年国内外主流AI大模型进行了对比分析。国外方面,OpenAI的ChatGPT具备强大的语言生成能力但存在事实准确性不足的问题;Anthropic的Claude强调安全可控,推理能力突出;Google的Gemini深度整合多模态功能但开放度有限。国内方面,百度的文心一言中文处理能力优异,科大讯飞的星火则在语音交互领域表现突出。总体来看,各大模型在性能、应用场景和商业化程度上各具特色,反

#人工智能#语言模型#python
AI办公助理:测试过199个AI工具,真正值得用的是这30个

AI办公工具精选指南:按任务场景匹配高效解决方案 本文针对职场人士提供了一份实用AI工具清单,核心标准是工具能否真正接管工作、产出可交付成果并融入实际流程。推荐30余款工具覆盖16类办公场景,包括综合任务处理(Codex、WorkBuddy)、写作生产(写作Skill)、PPT美化(PPT Skill)、表格处理(AI Excel Copilot)、知识管理(Obsidian)、团队协作(飞书)等

#人工智能#语言模型#python
到底了