logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

国产算力产业链最全梳理

迎来重大催化。8月22日至24日,在山西省大同市举办。本月国产芯片成果丰硕,华为Pura80系列搭载麒麟9020,新一代C86处理器性能提升,推出C6P系列CPU。此外,基于华为昇腾芯片的服务器产品陆续在政府、金融、运营商等行业落地大单。据国家数据局发布消息,截至2025年6月底,我国算力总规模位居全球第二。我国数字基础设施在规模、技术等方面已处于世界领先地位。

文章图片
#深度学习#人工智能#pytorch
未来想从事人工智能,本科阶段选什么专业合适?

实际上,该专业跟夸的天花乱坠的各类「智能」产品可能毫无关系,跟「天网」和「贾维斯」也毛线关系没有,更多的可能是数据集里藏着的噪声和异常值,以及一堆让人怀疑人生的loss曲线,说不定还有实验室一台显卡也没有的悲剧现实,让你连loss曲线都看不到。在他们看来,人工智能专业的学生仿佛每天都在打造下一个「天网」或者「贾维斯」,在数据洪流里随便摆弄几下,写下几行代码,一个操控人心的机器便出现了,一个无所不能

文章图片
#人工智能#深度学习
算力的多元计算维度:技术解析与可视化呈现

文章摘要: 算力度量呈现多样化特征,FLOPS、Hashrate和TPS分别对应不同技术场景。FLOPS通过浮点运算量化计算能力,实际利用率受内存带宽等因素影响;Hashrate专用于密码学领域,ASIC矿机在特定算法中表现突出;TPS则衡量分布式系统处理能力,受共识算法等要素制约。三种度量体系在核心载体、价值导向和发展趋势上存在显著差异,可视化工具可有效辅助技术选型和性能评估。建议根据具体应用场

#深度学习#人工智能
‌ 破局深度学习开发:算力、环境与管理的效率突围

实现“一次配置,多次复用”,开发者得以彻底告别重复的环境调试噩梦。结合实时的训练监控与分析仪表盘,开发者能清晰掌握每一次迭代的脉络,快速定位问题,显著提升实验效率与模型质量。在深度学习模型训练的征途中,开发者们常常被几座效率“大山”所困:昂贵的算力门槛、繁琐的环境配置、混乱的数据模型管理。技术平台的演进,其核心价值在于将开发者从繁琐的运维负担中解放出来,聚焦于核心的算法创新与模型优化。通过合理利用

#深度学习#人工智能
初学者入门大语言模型(LLM)完全指南:从理论到实践

大语言模型(LLM)已成为人工智能领域的核心技术,从 ChatGPT 到 LLaMA,从代码生成到智能问答,LLM 的应用无处不在。本文将以 “理论 + 实践” 为核心,带您从零开始掌握 LLM 的核心知识,逐步完成从 “了解” 到 “上手开发” 的跨越。例如,当输入 “今天天气很好,我想去” 时,LLM 会计算 “公园”“散步”“打球” 等词的概率,选择概率最高的词输出。:模型同时关注文本中不同

文章图片
#语言模型#人工智能#自然语言处理 +3
解读 Yann LeCun 的推文建议学生不要在大模型方向工作?

第一个是多模态大模型,当初Sora诞生时,很多人认为它就是world simulator,然而事实证明,尽管Sora能够生成视频,但它更多是一个视频工具,并不能很好地进行反事实推理(counterfactual reasoning),即在没有实际数据支持的情况下,准确回答“what if”类型的问题。由于模型所做的一切就是猜测下一个token,它们不真正“知道自己知道什么”,这也导致了大语言模型的

文章图片
#人工智能#深度学习#开源 +1
怎么看美团开源大模型 LongCat-Flash

美团的 LongCat-Flash 大模型凭借其创新的架构设计、高效的训练优化策略以及卓越的性能表现,在大模型领域中脱颖而出。尤其是在智能体任务处理方面,展现出了超越同类模型的优势,为复杂智能体应用的发展提供了有力支持。其开源的举措也将进一步推动行业的发展,促进更多开发者基于该模型进行创新和应用拓展。展望未来,随着技术的不断进步和优化,LongCat-Flash 有望在更多领域发挥重要作用,助力企

#人工智能#深度学习#开源
图灵奖得主 Yann LeCun:大模型是“死胡同”,下一步押在哪一条路?

2025年11月,深度学习领域出现重大转向:图灵奖得主Yann LeCun宣布离开Meta创办AMI公司,聚焦"世界模型"而非主流LLM路线。他与OpenAI前首席科学家Ilya Sutskever相继质疑大语言模型的局限性,认为LLM缺乏对物理世界的真实理解,单纯堆算力已接近天花板。LeCun提出JEPA新架构,通过多模态输入构建世界内部表征,强调行动智能而非语言模仿。同时,

文章图片
#人工智能#大数据#深度学习
大模型推理框架对比:SGLang 与 vLLM 的核心差异解析

SGLang 与 vLLM 并非替代关系,而是同源互补的推理框架:vLLM 擅长通用高并发推理,是简单对话场景的高效选择;SGLang 聚焦复杂结构化任务,通过前端 DSL 与 RadixAttention 技术,实现“可编程性+高效性”的统一,是 Agent 等复杂 LLM 应用的最优解。

文章图片
#sglang#AI#人工智能 +1
第二代PPTAgent来了!中科院软件所开源首个本地通用幻灯片智能体,9B参数打平GPT-5

以往的模型不知道自己生成的排版长什么样。更重要的是,所有生成内容均为 .pptx 可编辑格式,支持自由修改与二次创作,彻底摆脱类似 nanobanana 那样 “生成后无法编辑” 的困扰,让 PPT 创作真正可控、高效、灵活。更值得关注的是,在成本 — 性能曲线中,DeepPresenter-9B 位于前沿的 “突变点” 位置,意味着在性能与价格之间达到了极具竞争力的平衡。,实现了同等级别的智能表

文章图片
#人工智能#AI#大数据 +1
    共 107 条
  • 1
  • 2
  • 3
  • 11
  • 请选择