logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

MiniMax 偷偷发了新模型-M3

MiniMax低调发布新模型M3,支持1M超长上下文和多模态能力。该模型在计算效率上有显著突破,相比前代每token计算量仅为1/20,prefilling阶段提速9倍,decoding阶段提速15倍。首次实现原生多模态支持,方便开发者通过截图直接调试代码。报告显示新模型在保持全注意力机制性能的同时,大幅提升了成本效益,标志着长上下文和多模态技术的实用化突破。

文章图片
MiniMax M3,从入坑到头疼

摘要:用户在使用MiniMaxM3模型时遇到效率问题,原本简单的Browser-Bridge任务被拆分成19个子任务,但进展缓慢(1小时仅完成3个),且状态更新延迟。切换至GLM5.2模型后虽无thinking模式,但1M上下文仍带来改善。全文反映了AI工具在实际应用中的性能差异和使用挫败感。(99字)

文章图片
#经验分享
突然发现的一种Claude-mem 省钱方式

摘要:作者在使用Claude-mem时发现默认使用Gemini2.5-Flash模型,每月自动扣费50港币,但发现请求失败率高且额度消耗快。转用OpenRouter连接DeepseekV4-Flash时发现需支付8%服务费,后通过Byok功能绕过服务费,利用自有APIKey直接调用模型,100万请求内免手续费。目前正测试DeepseekV4-Flash的效果以降低成本。

文章图片
不听 Claude-mem 官方推荐立省 50

摘要:作者为节省Gemini每月50元的费用,折腾1小时改用OpenRouter接入DeepSeek,后又发现默认配置也能用。经池老师提醒,最终通过修改~/.claude-mem/.env文件配置国内API(如codingplan),省去订阅费用。具体步骤包括添加API密钥和地址、进入插件目录并重启Worker服务。整个过程体现技术爱好者对工具优化的执着,以及从复杂方案回归简洁实用的思考过程。(1

文章图片
Graphify 拯救了我的钱包

文章摘要:作者分享了一次关于节省AI编程工具token用量的思考。同事讨论CodexPro额度不足时,作者推荐了Graphify工具。虽然同事没采纳,但作者自己研究了Graphify的AST技术,发现它能通过代码结构分析精准定位,减少文件读取量。虽然暂时未见明显节省token,但代码定位效率显著提升。文章记录了技术探索中的犹豫、实践和发现,展现了开发者对工具优化的持续关注。

文章图片
#人工智能#ide
探索 OpenClaw 如何利用 Github 进行反馈循环

本文反思了反馈循环设计存在的问题,指出理想状态应是各环节相互独立。作者通过"升级龙虾导致飞书集成失败"的经历,发现反馈系统应设计为独立切面:错误发生时自动上报Issue,通过GitHub流程自动处理,人工只需审核。但作者也提出疑问:如何避免大量用户重复上报同一Issue?这需要进一步思考优化。这个案例展示了独立反馈机制的重要性,但也暴露出规模化时可能面临的新问题。

文章图片
#人工智能#经验分享
从一条用户评论到Browser Bridge的新功能-Tab隔离

本文记录了作者在推广 Browser Bridge 产品过程中的思考与迭代。从在掘金、知乎、CSDN 发帖讨论产品接受度开始,到通过用户反馈发现产品优化方向——需要兼容 Codex、Kimi Work 等竞品在使用浏览器时的细节体验。文章详细阐述了作者对产品定位的反思:当 Browser Bridge 的体验与主流竞品差距不大时,其"不绑定任何 Agent"和"能与任意 Agent 集成"的优势才

文章图片
#人工智能
管理TypeScript生态中的Monorepo项目

摘要:文章探讨了前端项目为何不像后端那样采用多模块管理,介绍了Monorepo的概念及其在TypeScript中的应用。2024年出现的pnpm、turbo等工具形成了行业标准,简化了多模块项目管理。作者反思了前端系统常见的代码冗余、依赖混乱问题,并对比了前后端开发的不同态度。最后提到Bun项目试图整合JavaScript工具链,解决前端生态碎片化问题。文章结合技术探讨与个人思考,揭示了前端工程化

文章图片
#typescript#javascript#前端
GLM 5.2 技术报告解读

上周,Anthropic因美国商务部要求,停掉外国人访问其前沿模型,甚至干脆对所有人关停,引发争议。智谱随即发布GLM-5.2并开源(MIT协议),强调“智能不应被少数规则收回”。技术解读方面,GLM-5.2在SWE-bench等跑分上接近前沿水平;其1M长上下文主要靠MLA(多潜变量注意力)压缩KV Cache、FP8量化减半显存,以及DSA稀疏注意力降低计算量(约1.5~2倍)来实现工程落地,

文章图片
#人工智能
TypeScript全栈踩坑日记-文章管理系统的迭代

本文分享了作者构建个人知识库网页版的经验。作者因习惯使用浏览器而非Obsidian,决定开发可视化网页管理剪藏内容。项目采用快速迭代方式,先用40分钟完成核心功能(需求分析10分钟,实现27分钟),后续通过多次小调整优化界面设计、修复Markdown渲染等问题。整个过程约1.5小时,重点解决了图片下载、页面美化等痛点。作者强调该项目主要满足个人使用习惯(情绪价值),并分享了"AI加速失败

文章图片
#人工智能#typescript#经验分享
    共 37 条
  • 1
  • 2
  • 3
  • 4
  • 请选择