logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

ChatGPT语音模式迎来史诗级进化:模型随你挑,推理深度自己定,语音AI的“自动挡“时代正式终结

曾经陪伴用户走过语音早期时代的"即时(Instant)"、"中速(Medium)"、"高级(High)"三个独立语音智能等级,随着新机制的落地正式退出历史舞台。这不是简单的功能删减,而是一次交互哲学的转向——过去的思路是"系统替你决定用多聪明",现在的逻辑是"你告诉系统要多聪明"。从"自动挡"切换到"手自一体",用户对语音AI的掌控感被前所未有地放大。是这套系统的"自动换脑"机制。当模型选择和推理

文章图片
#人工智能#语音识别
DeepSeek Flash系列9月10日再降价:缓存命中砍到0.02元,开发者这笔钱又能省回来了

DeepSeek Flash系列于2026年9月10日12:00起执行新定价,三档价格全线下调:空闲时段输入缓存命中降至每百万Token 0.02元(降幅60%),输入缓存未命中降至1元,输出降至4元,高峰时段对应翻倍。8月中旬DeepSeek V4系列转入峰谷计价,Flash系列空闲输入缓存命中0.05元、未命中1.5元、输出4.5元,高峰翻倍;空闲时段输入缓存命中每百万Token只要0.02元

文章图片
#人工智能
Qwen3.8-Flash-Next GGUF量化版本地部署全指南:从2位到6位精度的MoE大模型运行方案

由于它的量化维度160不能被256整除,这个张量无法使用K-quant,在Q6_K版本中会自动回退到Q8_0格式,单独占用一个约54.4GB的分片。这款由OrcaRouter团队推出的GGUF转换版本,不仅完整保留了原模型在视觉理解、工具调用和推理链条上的能力,更通过系统性的量化压缩,让普通开发者也能在本地硬件上跑通这个拥有512位专家的大型混合专家模型。量化方案的设计是这次发布的重头戏。K-qu

文章图片
#开源#开源软件#开源协议 +1
Claude Fable 5.2突袭倒计时?Anthropic被曝正在酝酿对GPT-6 Astra的绝地反击

更关键的是,在8月29日,该账号提前预言了Fable 5.1与Opus 5.1发布窗口的延迟,而几天后,也就是9月1日,Claude Fable 5.1果然如期登场。就在OpenAI用GPT-6 Astra点燃整个科技圈的第三天,一条来自X平台的消息像深水炸弹一样炸开了锅——那位曾经多次精准命中Anthropic内部动向的爆料者@kimmonismus,在9月5日扔出了一颗重磅炸弹:Anthrop

文章图片
#人工智能
Claude Fable 5.2突袭倒计时?Anthropic被曝正在酝酿对GPT-6 Astra的绝地反击

更关键的是,在8月29日,该账号提前预言了Fable 5.1与Opus 5.1发布窗口的延迟,而几天后,也就是9月1日,Claude Fable 5.1果然如期登场。就在OpenAI用GPT-6 Astra点燃整个科技圈的第三天,一条来自X平台的消息像深水炸弹一样炸开了锅——那位曾经多次精准命中Anthropic内部动向的爆料者@kimmonismus,在9月5日扔出了一颗重磅炸弹:Anthrop

文章图片
#人工智能
Claude Fable 5.2突袭倒计时?Anthropic被曝正在酝酿对GPT-6 Astra的绝地反击

更关键的是,在8月29日,该账号提前预言了Fable 5.1与Opus 5.1发布窗口的延迟,而几天后,也就是9月1日,Claude Fable 5.1果然如期登场。就在OpenAI用GPT-6 Astra点燃整个科技圈的第三天,一条来自X平台的消息像深水炸弹一样炸开了锅——那位曾经多次精准命中Anthropic内部动向的爆料者@kimmonismus,在9月5日扔出了一颗重磅炸弹:Anthrop

文章图片
#人工智能
沙箱崩塌!博通紧急披露VMware Workstation与Fusion致命漏洞:虚拟机逃逸直击主机核心

沙箱里的囚犯不仅逃出了牢房,还顺手拿到了整座监狱的钥匙。受影响的范围相当明确:VMware Workstation的25H2和26H1版本,以及运行在macOS上的VMware Fusion 25H2和26H1版本,无论底层宿主机是什么操作系统,统统暴露在风险之下。值得庆幸的是,这些漏洞是由善意的安全研究者私下报告给博通的,并非在野外被恶意利用后才曝光。从封闭的沙箱一跃进入生产环境,攻击者需要做的

文章图片
#网络#安全#web安全
OpenAI GPT-6 Astra百万Token上下文窗口正式开放,Codex长文本计费规则迎来颠覆性调整

OpenAI最新释出的支持文档彻底改写了这条游戏规则——GPT-6 Astra的上下文窗口实打实地撑到了一百万个token,而且在Codex环境里,超过二十七万token的长内容再也不用交"溢价保护费"了。对于依赖大模型处理海量信息的团队而言,费率结构的这一刀切下去,省下的不只是真金白银,更是原本用于拆分任务、管理上下文的隐性人力成本。输出端同样回归标准计价,不再有额外的倍率惩罚。以往玩过长文本的

文章图片
#人工智能
OpenAI GPT-6 Astra百万Token上下文窗口正式开放,Codex长文本计费规则迎来颠覆性调整

OpenAI最新释出的支持文档彻底改写了这条游戏规则——GPT-6 Astra的上下文窗口实打实地撑到了一百万个token,而且在Codex环境里,超过二十七万token的长内容再也不用交"溢价保护费"了。对于依赖大模型处理海量信息的团队而言,费率结构的这一刀切下去,省下的不只是真金白银,更是原本用于拆分任务、管理上下文的隐性人力成本。输出端同样回归标准计价,不再有额外的倍率惩罚。以往玩过长文本的

文章图片
#人工智能
AI编程代理会话录制完全指南:从Claude Code到Codex CLI的实战审计方案

但如果你让同一个CLI使用ChatGPT订阅登录,情况就彻底变了——它会停止与OpenAI端点通信,转而以你的身份进行认证,与其自身的后端通信。检查你的Agent框架是否读取base-URL环境变量,检查你的CI流水线是否能在启动时注入录制器地址,检查你的容器化部署是否支持orca attach模式。你在shell中设置的base-URL变量无法传递到容器内部,宿主机上的记录器也无法启动一个已经存

文章图片
#人工智能
    共 303 条
  • 1
  • 2
  • 3
  • 31
  • 请选择