
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
智谱AI正式发布新一代大模型GLM-5,此前匿名测试版"PonyAlpha"已在OpenRouter平台引发轰动。这款744B参数的模型采用DSA稀疏注意力架构,在编程和智能体任务上达到开源SOTA水平,实测对标ClaudeOpus4.5。GLM-5率先海外上线并提价30%-100%,同时开源MIT协议版本,支持多语言和主流开发工具。作为国产大模型出海里程碑,GLM-5展现了在

本周,全球AI编程领域发生了一起极具戏剧性的“反转”事件。长期被视为硅谷AI明星初创公司的Cursor,在发布其号称拥有“巅峰级编程智慧”的新一代模型Composer 2后,迅速陷入了一场关于技术原创性的信任危机。不同于以往的技术迭代赞美,这次迎接他们的是来自开发者社区的“代码 forensic(取证)”。

【摘要】2026年5月,Anthropic发布Claude Opus4.8大模型,以性能登顶、速度翻倍、成本暴降的突破性升级震撼行业。该模型在编程(SWE-Bench 69.2%)、智能体操作(OSWorld 83.4%)等核心测试中超越GPT-5.5和Gemini3.1Pro,快速模式成本降至1/3且速度提升2.5倍。三大创新亮点包括:1)具备纠错质疑能力的智能体协作;2)可调节的Effort推

腾讯开源专为机器人设计的HY-Embodied-0.5-X多模态大模型,采用创新的MoT架构,在22项评测中获得16项最佳。该模型包含2B端侧版和32B复杂推理版,具备空间感知、动作规划和风险预判能力,基于超1亿条专属数据训练。其核心优势在于实时视觉处理和高精度动作执行,使机器人能更好地适应真实场景。目前模型已在GitHub和HuggingFace开源,可应用于家庭服务和工业生产线等领域,推动具身

2026年7月中美AI博弈升级,阿里官宣7月10日全面禁用Claude全系列模型,Anthropic同步大规模封禁中国用户,叠加开发者曝光其内置Unicode隐写追踪机制,国内海外大厂同步收紧跨阵营模型权限,全球AI产业正式进入双向封锁、阵营割裂的新阶段。

阿里于2026年7月19日发布通义千问新一代旗舰模型Qwen3.8-Max-Preview,总参数量达2.4万亿,成为全球仅次于Claude Fable5的顶尖大模型。该预览版支持多模态输入(文本、图片、视频等),优化了多智能体协作、大型工程开发等场景,并承诺正式版将开放模型权重。核心升级包括全栈代码开发能力、多Agent任务稳定性、多模态深度融合等。模型提供分层订阅方案,面向企业、开发者等不同用

阿里云推出千问家族旗舰大模型Qwen3.8-Max,参数规模达2.4万亿,采用MoE架构,强调端到端自主执行能力。该模型突破传统问答局限,具备持续自我演化开发、长周期任务处理、原生多模态智能等核心能力,适用于复杂商业与科研场景。下周将开源Qwen3.8-Max及轻量版Qwen3.8-27B权重文件,公布国际API定价。分析师指出,国产大模型开源趋势正改变行业竞争格局,从参数比拼转向实际应用能力竞争

智谱AI联合驭驯网络、清华大学推出新一代ZCube组网架构,在GLM-5.1coding生产环境中实现规模化落地。该架构采用扁平化二部图互联设计,在不更换GPU和软件栈的情况下,显著提升大模型推理性能:推理吞吐提升15%,网络硬件成本降低33%,首Token时延减少40.6%。ZCube解决了传统多层Clos架构的拥塞问题,支持超大规模GPU集群的线性扩展,为AI算力效率提升提供了创新解决方案。这

Google正式发布Gemini2.5FlashImage,揭开了此前在AI社区引发轰动的神秘模型"NanoBanana"的面纱。这款图像编辑器在盲测中展现出惊人的编辑效果和一致性表现,人脸保持度和风格一致性高达90-95%。核心优势包括自然语言编辑、一次性精准修改、角色一致性维护和多图像融合能力,适用于创意设计、广告营销等多个领域。目前可通过GoogleAIStudio和Ge

微软推出轻量级实时语音模型VibeVoice-Realtime-0.5B,仅0.5B参数却实现300毫秒超低延迟响应,支持中英文流畅转换。该模型能稳定输出90分钟语音,支持4角色自然对话,并具备细腻的情感表达和稳定的上下文记忆能力。相比传统大模型,其轻量化设计更适合智能设备集成,为智能助手、对话系统等场景带来更自然的交互体验。模型已在Hugging Face平台开源,标志着AI语音技术向实时化、轻








