logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

ORA-00257: archiver error. Connect internal only, until freed. (转)

ORA-00257: archiver error. Connect internal only, until freed.,sql,sql教程,Oracle基础环境:winxp+oracle9.2.0.1客户端...

#数据库
在ASP中用“正则表达式对象”来校验数据的合法性(转)

我们在制作网站的时候,尤其是各种电子商务网站,首先都会让用户填写一些表格来获取注册用户的各种信息,因为用户有可能输入各式各样的信息,而有些不符合要求的数据会给我们的后端ASP处理程序带来不必要的麻烦,甚至导致网站出现一些安全问题...

#javascript#后端#数据库
让NIS(诺顿)管好计算机端口(转)

可能很多人都在使用NIS(Norton Internet Security,即诺顿网络防火墙),当安装好NIS后,它已经设置最常用保护功能。但是,其默认设置并不是太好,很多时候我们需要对它作一些调整。     一、关闭危险端口 ...

#网络
国外可以免费发布供求信息的网站(转)

1、Algomtl http://www.algomtl.com/algopages.html 语种:英文 2、allactiontrade http://www.allactiontrade.com/ 语种:英文 3、b2s ...

不用暴力破解软件,去除word保护密码(转)

如果您有一定的电脑基础,您可以试一下以下方法: 1、首先用Word 2003打开已设置有密码的“保护文档”(原始DOC文件),此文档可由Word 2000/XP(2002)/2003创建(保护文档创建方法见上文); 2、在菜单中...

开源大模型核心参数解析与应用指南

Transformer架构作为现代大语言模型的基础,通过自注意力机制实现长序列建模。开源模型通过公开权重和架构,降低了AI技术使用门槛,其核心差异体现在基础架构、训练数据和参数规模三个维度。在实际工程部署中,参数规模与硬件需求的平衡、注意力头数与上下文长度的配置、以及量化等级的选择,直接影响模型的推理效率和成本。以Llama、Qwen等典型开源模型为例,7B参数模型配合Q4_K_M量化可在消费级显

数据科学项目Docker化:解决环境一致性与可复现性难题

容器化是保障数据科学项目环境一致性与可复现性的核心技术手段,其原理在于通过镜像封装代码、依赖及运行时环境,实现跨平台、跨机器的确定性执行。相比Conda导出或虚拟机方案,Docker凭借轻量隔离、快速启动和精准版本控制,成为MLOps落地的基础设施支撑。它不仅规避了‘在我机器上能跑’的协作困境,更支撑模型从本地实验到GPU云服务、客户内网等多场景稳定交付。本文聚焦数据科学特有的CUDA依赖、多层包

大模型智能体(Agent)开发实战:架构设计与优化策略

大模型智能体(Agent)作为AI领域的前沿技术,通过感知、决策、执行的闭环架构实现了任务自动化处理。其核心技术原理结合了多模态输入处理、思维链推理和工具调用机制,在电商客服、智能助手等场景展现巨大价值。开发过程中需特别注意感知模块的多线程安全、决策层的CoT优化以及执行层的沙箱隔离。针对性能瓶颈,可采用请求合并、异步流水线等优化策略,配合LangChain、vLLM等工具链实现高效开发。随着多智

小米MiMo-V2.5-DFlash:基于block-diffusion推测解码的大模型6倍加速方案

推测解码是大模型推理加速的核心技术之一,其原理是通过小型草稿模型预先生成候选token序列,再由主模型进行验证,从而减少自回归解码的计算开销。这种技术在工程实践中能够显著提升推理效率,特别适用于代码生成、文本补全等高吞吐量场景。block-diffusion作为推测解码的创新变体,采用并行预测整块token的方式,相比传统逐个token推测具有更高的并行度。小米技术团队发布的MiMo-V2.5-D

AI大模型推理优化:动态计算图与混合量化技术

AI推理优化是提升大模型性能的关键技术,其核心在于计算图优化与量化压缩。动态计算图技术通过实时语义分析实现算子融合与稀疏化,显著降低计算开销。混合精度量化则平衡精度与速度,FP8动态量化精度损失小于1%的同时实现3.2倍加速。这些技术在自动驾驶、推荐系统等高并发场景中尤为重要,能有效解决模型复杂度与硬件算力的矛盾。以Transformer架构为例,动态稀疏注意力与分层量化可提升47%的推理速度,同

    共 168 条
  • 1
  • 2
  • 3
  • 17
  • 请选择