logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

ollama v0.32.14正式发布:WebP 自动转码、Qwen 系统消息兼容升级与 llama.cpp、MLX 更新全解析

如果检测到输入为 WebP,则会先解码为图像,再编码为 PNG,最后将 PNG 数据传递给后续请求。可以确认的是,该文件属于 LLM 图片集成测试,并且此次 v0.32.14 的核心更新之一正是 llama-server 对 WebP 图片的转码处理。此外,版本还更新了 llama.cpp、MLX 的版本标识,登记了 DeepSeek Harness 文档入口,并更新了相关模型启动示例。通过这一函

#java#android
ComfyUI v0.27.0更新:Int8模型正式落地,卷积模型加速、Turing显卡支持、视频与多分辨率能力全面增强

ComfyUI 发布了 v0.27.0 最新版本,发布时间为 2026 年 7 月 2 日。这个版本属于一个重要更新版本,发布信息中明确指出:这是一个不可变发布版本,只有发布标题和发布说明可以被修改。从整个更新内容来看,本次版本最核心、最值得关注的变化,就是新增了对 int8 convrot models 的支持。

#音视频#golang
ollama v0.15.2发布:新增Clawdbot集成指令,全面支持Ollama模型启动!

代码地址:github.com/ollama/ollamaOllama v0.15.2 是一次“小而强”的版本更新。它主打:✅Clawdbot 全新支持— 让开发者可直接用 Ollama 模型启动智能代理网关。✅高度自动化配置管理— 无需人工编辑配置文件,即可完成本地模型挂载。✅完善测试与安全机制— 625 行测试覆盖所有边缘场景,保证稳定性与可回滚性。✅生态扩展— Clawdbot 现已加入 O

#golang
dify 1.16.1 新版本深度评测:内部服务 Token 认证、Agent 沙箱代理隔离、性能大幅优化

Dify 最新稳定版本v1.16.1已经正式推送,本次版本定位为Bug修复+安全增强版本,同时配套上线多项实用新功能、性能优化,重点强化Agent沙箱安全边界、内部服务通信安全,修复大量工作流协同、RAG知识库、Agent应用、前端UI、后端API存在的问题。本次更新包含新增功能、全域Bug修复、多项关键性安全加固、接口性能优化、环境变量调整、数据库迁移脚本、Docker Compose配置变更。

RAGFlow v0.25.0:全新发布,覆盖解析管道、数据源、Agent、语言界面、模型支持与安全修复的全面升级

代码地址:github.com/infiniflow/ragflow文档接入更强:pipeline、preprocess、解析器、OCR、DOCX/Excel 懒加载全面增强数据源更广:Seafile、RSS、DingTalk AI Sheet 等新增接入Agent 更完整:发布、版本管理、sandbox、数据分析模板、图表生成、记忆系统都更成熟国际化更彻底:新增阿拉伯语、保加利亚语、土耳其语,并

ollama v0.32.11更新:DeepSeek Harness、Muse Code 接入,Responses API 支持 Web Search

这项调整的意义在于:当模型被用于 Muse Code 场景时,Ollama 的模型渲染和推理格式能够更好地匹配 Muse Glimmer 模板要求,从而让输出格式、推理模板和工具型编程工作流之间保持一致。本次新增的 DeepSeek Harness 集成文档,完整覆盖了安装、启动、模型选择、Web Search、配置位置和参数传递规则。随着 DeepSeek Harness 和 Muse Code

#前端
ollama v0.32.11更新:DeepSeek Harness、Muse Code 接入,Responses API 支持 Web Search

这项调整的意义在于:当模型被用于 Muse Code 场景时,Ollama 的模型渲染和推理格式能够更好地匹配 Muse Glimmer 模板要求,从而让输出格式、推理模板和工具型编程工作流之间保持一致。本次新增的 DeepSeek Harness 集成文档,完整覆盖了安装、启动、模型选择、Web Search、配置位置和参数传递规则。随着 DeepSeek Harness 和 Muse Code

#前端
ComfyUI v0.32.0更新:PyTorch 2.7成最低支持版本,LTX 2.5、Qwen-Image 3.0 Pro、Grok Imagine Image 2.0全面接入

对于使用 MiniMax-H3、LTX、Qwen、Grok、分块解码、低显存放大、资产 API 以及 Mistral、Llama tokenizer 的用户,本次更新包含了直接相关的功能支持或问题修复。对于显存资源有限的设备,低显存模式往往是维持工作流可运行的重要选择。对于使用 LTX 系列模型的用户来说,v0.32.0 带来了对 2.5 版本的直接支持,并同步提供了对应的新节点能力。本次版本覆盖

#pytorch#人工智能#python
ollama v0.20.7 最新版更新详解:ROCm 7.2.1、Gemma4 渲染修复与多项 Metal/Renderer 回归修补

代码地址:github.com/ollama/ollamaollama v0.20.7 虽然是一个小版本号更新,但内容并不轻量。修复 gemma:e2b 和 gemma:e4b 在关闭 thinking 时的质量问题Linux 下 ROCm 升级到 7.2.1Gemma4 renderer 进行多轮修复与回滚,最终恢复 e2b-style nothink promptGemma4 测试模板新增与重

#回归#数据挖掘#人工智能
ollama v0.32.6 正式发布:Apple GPU 推理加速、流式接口对齐、云端模型调用优化与 TUI 体验修复

从更新内容来看,v0.32.6 并不是一次单纯新增功能的版本,而是围绕现有能力进行优化和修复:在 Apple GPU 场景下,MLX 引擎能够自动使用模型的 MTP head 进行推测解码;对于已经在使用 v0.32.5 图像生成能力的用户而言,最重要的信息就是:如果图像生成是当前工作流中的必要部分,不应仅因为 v0.32.6 带来了其他优化而忽略该功能已经暂时移除的事实。也就是说,在满足相关模型

    共 549 条
  • 1
  • 2
  • 3
  • 55
  • 请选择