
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
简单来说,AI智能体是一个能够感知环境并采取行动以实现特定目标的系统。它是大语言模型(LLM)的进化版本,增强了规划、使用工具和与环境交互的能力。接受任务:你给它一个目标,如"整理我的日程"扫描环境:收集所有必要信息——读取邮件、检查日历、访问联系人制定计划:思考实现目标的最佳方法执行行动:发送邀请、安排会议、更新日历学习改进:观察结果并适应调整,持续优化这种循环机制让AI智能体能够像人类助手一样

Moonshine 是由 Useful Sensors公司推出开源的语音到文本(speech-to-text, STT)转换模型,旨在为资源受限设备提供快速而准确的自动语音识别(ASR)服务。Moonshine 基于先进的编码器-解码器架构,采用了Transformer模型。其编码器部分负责处理输入的语音信号,而解码器部分则生成文本输出。Moonshine模型具有以下特点:开源tiny版本,参数量

昨天文章发出去后,有不少同学问:在哪里下载 Gemini 3、怎么使用?大部分问的人都是互联网行业外的,显然 Gemini 3 是不用下载的,只要用就可以了。下面介绍几种使用 Gemini 3 的方法。

这篇文章解决了传统手动复制粘贴方式,容易格式出错,出现多余字符等的问题。本文介绍了上面的解决方法,让 DeepSeek-R1 模型直接生成可下载的 Word、PDF、Excel 等格式文档。通过一句简单提示词,即可生成带有下载按钮的 HTML 预览,提升了导出效率和格式兼容性。在 DeepSeek-R1 的 0528 新版本中,推理能力提升较多,数学场景中 token 使用量翻倍,准确率显著提升,
扩散模型(Diffusion Models)是一种新型的生成模型,其灵感来源于非平衡热力学中的扩散过程。这种模型通过模拟从数据集中逐步添加噪声的过程,直至数据完全转化为噪声,然后再通过逆向过程从噪声中恢复出原始数据。扩散模型的起源可以追溯到2015年,当时有研究者提出了深度生成模型(Deep Generative Models),这为后来的扩散模型奠定了基础。2018年,Diffusion Mod

B 站的秋叶大佬在 1 月份就已经发布了 comfy ui 的整合包。用户将压缩包下载后,能够一键启动 comfy ui。其便利性与之前的 webui 整合包如出一辙。然而在整合包下载完成后,新手或许会遭遇插件以及模型缺失的情况,同时也不清楚该如何运行工作流等问题,本文将引领大家完成 comfy ui 的安装,并运行首个工作流。何为 comfy ui 呢?先来瞧瞧 webui 与 comfy ui

Stable Diffusion 的 ControlNet 是一个控制预训练图像扩散模型的神经网络。它允许输入调节图像,然后使用该调节图像来操控图像生成。ControlNet 最近非常火,它和 Stable Diffusion 的结合使 Stable Diffusion 能够接受指导图像生成过程的条件输入,从而增强了 Stable Diffusion 的性能。使用 ControlNet 可以固定构

最近在搞AI. 遇到了一个问题,就是要进行doc文档的解析。并且需要展示每个文档的总页数。利用AI. 分别尝试了chatGPT, 文心一言, github copilot,Kimi 等工具,给出来的答案都不尽如人意。给的最多的查询方式就是下面这种。这个给大家避雷一下。使用python-docx的方式,是没有办法获取文档总页数的。如果想获取,也只能是获取一个近似值,大体就是根据每个页面平均有多少个段

随着生成式大语言模型能力的显著提升,智能体(AI Agent)在近期成为人工智能行业备受关注的名词之一,作为人工智能技术的前沿应用,其在行业发展过程中扮演着至关重要的角色智能体的自主性、适应性和学习能力使其能够在复杂环境中高效执行任务,从而提高生产效率、降低成本并创造新的经济价值。**在2024年《11月大模型热力榜》中,大模型之家榜单共收录了214家大型模型及其所属企业。**本月,百度与智谱依然

根据《2024 年全球人工智能行业报告》最新的数据显示,全球 AI 市场预计将以每年超过 40% 的速度增长,到 2030 年市值将达到数万亿美元,这也是预示着在接下来的十年到十五年里,人工智能将获得巨大的发展红利。在过去的一年多时间里,我持续关注着大模型的发展趋势,并且尽可能地进行了尝试和实践。在学习的过程中,遭遇了不少问题,可能你也碰到过,比如:如何在众多模型中选择合适自己领域的模型并进行优化








