logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

ollama v0.30.7 正式发布:Hermes 桌面端落地,接口、文档、底层依赖全方位优化

代码地址:github.com/ollama/ollamaOllama v0.30.7 是一次兼顾功能新增、体验优化、底层规范、接口兼容、文档完善的综合性版本更新。从用户使用层面,Hermes Desktop 原生桌面界面上线,让智能代理告别纯命令行操作,可视化管理能力大幅提升,同时优化了 Windows 平台的目录适配,提升跨平台使用体验;从开发者层面,Zod 结构化输出语法简化、OpenAI

#log4j#golang
ollama v0.30.8 最新更新解读:修复启动提供方选择错误,提示词缓存更稳,MLX 推理与递归模型全面增强

代码地址:github.com/ollama/ollama最后,把本次更新浓缩成一句话:ollama v0.30.8 是一次围绕启动稳定性、缓存复用、MLX 推理可靠性和 recurrent model 支持进行的底层优化版本。启动 provider 选择修复prompt caching 优化MLX linear 和 embedding layers 加固prompt processing 与 s

ollama v0.30.9更新详解:Cohere2Moe支持落地,LFM2思维链解析修复,超长上下文报错机制上线

从这次发布信息来看,虽然版本号只是一次常规迭代,但实际改动并不小,覆盖了模型架构支持、LFM2 解析与渲染修复、ollama 在启动 Claude 及其他 coding agent 或 assistant 场景下只输出一个 token 的问题修复,以及单条消息超过当前上下文窗口时直接返回错误的新机制。虽然在用户给出的 diff 片段中,没有展开 Cohere2Moe 具体实现文件的完整细节,但这项

#android#数据库#服务器
ollama v0.30.10更新详解:Apple Silicon原生支持Command A与North家族,llama.cpp升级到b9672,Cohere2 MoE全链路接入MLX

它还明确指出,模型特定的平台系统指令,比如 identity 和默认 policies,不在渲染器里硬编码,而是依赖模型的 Modelfile SYSTEM prompt 或请求中的第一条 system message。从这次更新内容来看,版本体量并不只是一次常规修复,而是围绕 Apple Silicon、MLX 引擎、Cohere2 MoE 模型体系、解析器与渲染器能力、导入量化策略以及发布构建

ollama v0.31.1发布:Apple Silicon上Gemma 4提速近90%,默认开启无感升级

根据发布内容,Gemma 4 现在在 Ollama 的 Apple Silicon 环境中获得了显著加速,依靠 multi-token prediction,也就是 MTP,多 token 预测机制,在一个 coding-agent benchmark 上,平均 token 生成速度提升接近 90%。可以看到,这次更新并不是单点优化,而是围绕 Gemma 4 在 Apple Silicon 上的运

#golang
ollama v0.32.1发布详解:工具调用更稳、多轮推理更强、内存泄漏修复、模型加载超时生效与交互体验全面升级

当模型判断需要借助外部工具时,工具调用本身只是中间步骤,真正关键的是工具执行完成之后,模型能不能把结果“接住”。多轮推理本身对上下文组织要求更高,尤其当中间还穿插了工具调用时,模型必须同时处理“历史对话”“当前任务”“工具结果”和“下一步推理”。从内容上看,这一版的重点并不在“堆叠新功能”,而在于“把已有能力做得更稳、更顺、更适合真实开发环境”。修复后,跨请求运行的稳定性预期会更好。如果加载超时配

#golang
ollama v0.32.3发布:模型下载卡顿修复、Windows ARM64 CUDA支持、Laguna工具调用全面升级

另一方面持续扩大硬件与模型兼容范围,包括 Windows ARM64 平台 CUDA 支持、通过 CUDA 12 支持 B200、Linux CUDA 与 ROCm 集成显卡降低内存使用,以及 Laguna 2.1 模型的聊天、思考和工具调用能力支持。这些调整虽然更多体现在内部结构和交互流程上,但也表明 v0.32.3 持续在简化不再需要的逻辑,减少冗余结构,并优化终端与 agent 使用过程中的

#windows
ollama v0.32.4 发布:Laguna 登陆 Apple GPU,Qwen3 MoE 解码修复与 Agent 技能权限全面升级

除此之外,提交记录还显示,本次版本包含 Agent 技能权限加载、终端界面中的 Agent 系统提示命令、MLX 已加载模型内存驻留、调度器 loaded map 数据竞争修复,以及更新器和传输单元测试强化等内容。从已给出的代码注释看,模型主动加载需要审批的直接原因,是技能中的指令会影响后续运行过程;其中,面向 Apple GPU 的 MLX 引擎能力扩展、不同量化格式专家模型的解码修复、打包 g

#servlet#java#开发语言
ragflow v0.20.5 更新详解:性能优化、Agent 框架开放、SQL 组件增强

版本不仅在 Agent 性能、SQL 查询、检索功能等核心能力上实现了升级,还针对多项 UI 细节和开发体验进行了优化。对于需要高效构建多智能体系统、处理复杂检索任务或进行跨语言内容处理的开发者来说,此次更新将显著提升生产力与可扩展性。

#性能优化#sql#数据库
ollama v0.32.4 发布:Laguna 登陆 Apple GPU,Qwen3 MoE 解码修复与 Agent 技能权限全面升级

除此之外,提交记录还显示,本次版本包含 Agent 技能权限加载、终端界面中的 Agent 系统提示命令、MLX 已加载模型内存驻留、调度器 loaded map 数据竞争修复,以及更新器和传输单元测试强化等内容。从已给出的代码注释看,模型主动加载需要审批的直接原因,是技能中的指令会影响后续运行过程;其中,面向 Apple GPU 的 MLX 引擎能力扩展、不同量化格式专家模型的解码修复、打包 g

#servlet#java#开发语言
    共 557 条
  • 1
  • 2
  • 3
  • 56
  • 请选择