- 模型量化技术简要详解 模型量化的本质与基础原理模型量化技术本质上是一种精度与效率的权衡艺术。想象一下,如果我们用数字来记录一个房间的温度,使用小数点后十位的精度(如23.1234567890°C)虽然非常精确,但在日常生活中,精确到小数点后一位(23.1°C)就足够了。模型量化的核心思想与此类似——将神经网络中的高精度浮点数(通常是32位浮点数,FP32)转换为低精度的整数表示(如8位整数... 模型量化技术简要详解 模型量化的本质与基础原理模型量化技术本质上是一种精度与效率的权衡艺术。想象一下,如果我们用数字来记录一个房间的温度,使用小数点后十位的精度(如23.1234567890°C)虽然非常精确,但在日常生活中,精确到小数点后一位(23.1°C)就足够了。模型量化的核心思想与此类似——将神经网络中的高精度浮点数(通常是32位浮点数,FP32)转换为低精度的整数表示(如8位整数...
- NLP参数高效迁移学习:Adapter方法的深度解析Houlsby N, Giurgiu A, Jastrzebski S, et al. Parameter-efficient transfer learning for NLP[C]//International conference on machine learning. PMLR, 2019: 2790-2799. 第一章 引言与... NLP参数高效迁移学习:Adapter方法的深度解析Houlsby N, Giurgiu A, Jastrzebski S, et al. Parameter-efficient transfer learning for NLP[C]//International conference on machine learning. PMLR, 2019: 2790-2799. 第一章 引言与...
- 数据喂得好,机器人才能学得快:大数据对智能机器人训练的真正影响 数据喂得好,机器人才能学得快:大数据对智能机器人训练的真正影响
- 你是否曾想过让强大的开源大模型(LLM)更懂你的专业领域,或者更能模仿你的写作风格?微调(Fine-Tuning)就是实现这一目标的钥匙。过去,微调是资源雄厚的大公司的专利,动辄需要数十张GPU和复杂的分布式训练知识。但现在,感谢 Ollama 和 Python 生态的强大工具,这一切变得前所未有的简单。本文将手把手带你,用一个消费级GPU(甚至CPU!),在1小时内完成属于你自己的模型微调... 你是否曾想过让强大的开源大模型(LLM)更懂你的专业领域,或者更能模仿你的写作风格?微调(Fine-Tuning)就是实现这一目标的钥匙。过去,微调是资源雄厚的大公司的专利,动辄需要数十张GPU和复杂的分布式训练知识。但现在,感谢 Ollama 和 Python 生态的强大工具,这一切变得前所未有的简单。本文将手把手带你,用一个消费级GPU(甚至CPU!),在1小时内完成属于你自己的模型微调...
- pytorch量化[!note]官方定义:performing computations and storing tensors at lower bitwidths than floating point precision.支持INT8量化,可以降低4倍的模型大小以及显存需求,加速2-4倍的推理速度通俗理解:降低权重和激活值的精度(FP32→INT8),从而提高模型大小以及显存需求。 ... pytorch量化[!note]官方定义:performing computations and storing tensors at lower bitwidths than floating point precision.支持INT8量化,可以降低4倍的模型大小以及显存需求,加速2-4倍的推理速度通俗理解:降低权重和激活值的精度(FP32→INT8),从而提高模型大小以及显存需求。 ...
- Word2Vec How achieve Lookup table Coding Pre-dataing Model Negative sameple Word2Vec单词与单词之间的向量往往不在同一个向量空间,例如,传统的编码方式:one-hot编码,不同单词[1, 0, 0]和[0, 1, 0]之间的余弦相似度为0。因此,Word2Vec希望能够通过训练得到一个新的词向量表达方式,从而... Word2Vec How achieve Lookup table Coding Pre-dataing Model Negative sameple Word2Vec单词与单词之间的向量往往不在同一个向量空间,例如,传统的编码方式:one-hot编码,不同单词[1, 0, 0]和[0, 1, 0]之间的余弦相似度为0。因此,Word2Vec希望能够通过训练得到一个新的词向量表达方式,从而...
- Adaboost 一、基本内容[!note]实现思路:在每一轮训练中,记录每一次由f(x)=∑m=1i−1αmGm(x)f(x) = \sum_{m=1}^{i-1}\alpha_mG_m(x)f(x)=∑m=1i−1αmGm(x)【错误\正确】分类的样本,在加入新的弱学习器中【提高\降低】分类【错误\正确】样本的权值(即改变样本的比例,类似过采样与降采样)加法模型:多个弱分类器Gm... Adaboost 一、基本内容[!note]实现思路:在每一轮训练中,记录每一次由f(x)=∑m=1i−1αmGm(x)f(x) = \sum_{m=1}^{i-1}\alpha_mG_m(x)f(x)=∑m=1i−1αmGm(x)【错误\正确】分类的样本,在加入新的弱学习器中【提高\降低】分类【错误\正确】样本的权值(即改变样本的比例,类似过采样与降采样)加法模型:多个弱分类器Gm...
- 一、前置知识 真阳性(TPR):正样本被正确分类个数与所有正样本的总数的比值TPR=TPTP+FNTPR = \frac{TP}{TP+FN}TPR=TP+FNTP 假阳性(FPR):负样本被错误分类个数与所有负样本的总数的比值FPR=FNFN+TNFPR=\frac{FN}{FN+TN}FPR=FN+TNFN 其中,TP表示正确分类的正样本,TN表示正确分类的负样本,FN表示错... 一、前置知识 真阳性(TPR):正样本被正确分类个数与所有正样本的总数的比值TPR=TPTP+FNTPR = \frac{TP}{TP+FN}TPR=TP+FNTP 假阳性(FPR):负样本被错误分类个数与所有负样本的总数的比值FPR=FNFN+TNFPR=\frac{FN}{FN+TN}FPR=FN+TNFN 其中,TP表示正确分类的正样本,TN表示正确分类的负样本,FN表示错...
- BLIP2 跌倒项目实战(一) BLIP2 跌倒项目实战(一)
- MicroNAS:面向MCU的零样本神经架构搜索Qiao Y, Xu H, Zhang Y, et al. Micronas: Zero-shot neural architecture search for mcus[C]//2024 Design, Automation & Test in Europe Conference & Exhibition (DATE). IEEE, 202... MicroNAS:面向MCU的零样本神经架构搜索Qiao Y, Xu H, Zhang Y, et al. Micronas: Zero-shot neural architecture search for mcus[C]//2024 Design, Automation & Test in Europe Conference & Exhibition (DATE). IEEE, 202...
- H4H:面向AR/VR应用的NPU-CIM异构系统混合卷积-Transformer架构搜索Yiwei Zhao, Jinhui Chen, Sai Qian Zhang, Syed Shakib Sarwar, Kleber Hugo Stangherlin, Jorge Tomas Gomez, Jae-Sun Seo, Barbara De Salvo, Chiao Liu, Phil... H4H:面向AR/VR应用的NPU-CIM异构系统混合卷积-Transformer架构搜索Yiwei Zhao, Jinhui Chen, Sai Qian Zhang, Syed Shakib Sarwar, Kleber Hugo Stangherlin, Jorge Tomas Gomez, Jae-Sun Seo, Barbara De Salvo, Chiao Liu, Phil...
- SmoothQuant: 大型语言模型的精确高效后训练量化Xiao G, Lin J, Seznec M, et al. Smoothquant: Accurate and efficient post-training quantization for large language models[C]//International conference on machine learni... SmoothQuant: 大型语言模型的精确高效后训练量化Xiao G, Lin J, Seznec M, et al. Smoothquant: Accurate and efficient post-training quantization for large language models[C]//International conference on machine learni...
- GES DISC 上的 AIRS/Aqua L2 标准物理检索 (AIRS+AMSU) V006 (AIRX2RET)简介大气红外探测器 (AIRS) 是安装在第二个地球观测系统 (EOS) 极地轨道平台 EOS Aqua 上的一台光栅光谱仪 (R = 1200)。AIRS 与先进微波探测装置 (AMSU) 和巴西湿度探测器 (HSB) 结合,构成了一个由可见光、红外和微波传感器组成的创新... GES DISC 上的 AIRS/Aqua L2 标准物理检索 (AIRS+AMSU) V006 (AIRX2RET)简介大气红外探测器 (AIRS) 是安装在第二个地球观测系统 (EOS) 极地轨道平台 EOS Aqua 上的一台光栅光谱仪 (R = 1200)。AIRS 与先进微波探测装置 (AMSU) 和巴西湿度探测器 (HSB) 结合,构成了一个由可见光、红外和微波传感器组成的创新...
- 嵌入式AI领域关键技术的理论基础 引言嵌入式AI的核心挑战在于如何在极其有限的计算和存储资源下实现高性能的智能推理。这需要我们从数学原理出发,理解模型压缩、优化和部署的本质。 第一部分:神经网络量化的完整理论体系 1.1 量化的信息论基础 1.1.1 从连续到离散:信息损失的数学刻画考虑一个连续随机变量X∈RX \in \mathbb{R}X∈R,其概率密度函数为p(x)p(x)p(x)。... 嵌入式AI领域关键技术的理论基础 引言嵌入式AI的核心挑战在于如何在极其有限的计算和存储资源下实现高性能的智能推理。这需要我们从数学原理出发,理解模型压缩、优化和部署的本质。 第一部分:神经网络量化的完整理论体系 1.1 量化的信息论基础 1.1.1 从连续到离散:信息损失的数学刻画考虑一个连续随机变量X∈RX \in \mathbb{R}X∈R,其概率密度函数为p(x)p(x)p(x)。...
- 用于最近邻搜索的乘积量化H. Jégou, M. Douze and C. Schmid, “Product Quantization for Nearest Neighbor Search,” in IEEE Transactions on Pattern Analysis and Machine Intelligence, vol. 33, no. 1, pp. 117-128, Ja... 用于最近邻搜索的乘积量化H. Jégou, M. Douze and C. Schmid, “Product Quantization for Nearest Neighbor Search,” in IEEE Transactions on Pattern Analysis and Machine Intelligence, vol. 33, no. 1, pp. 117-128, Ja...
上滑加载中
推荐直播
-
华为云码道Agent集成与鸿蒙实战2026/08/11 周二 19:00-21:00
王一男-华为云码道产品规划专家;李炎-华为云码道产品专家;彭江敏-华为云鸿蒙端云一体化开发专家
本次直播带你解读华为云码道7月份产品新特性、新功能。更有专家演示码道Agent Space × 钉钉机器集成实战,从0到1打通消息通道;码道鸿蒙端云一体化实战,快速搭建员工签到系统。
回顾中 -
华为云开发者AI素养直播课·第五期2026/09/04 周五 16:00-18:00
林华鼎-华为云AI开发者运营负责人;蒋春阳-华为云AI开发者案例开发专家
本期直播内容: AI工具体验营 · 第5-8课连讲。Agent-Team 多智能体协作完成毕业设计实践
回顾中 -
华为云开发者AI素养ClassRoom·第六期2026/09/08 周二 19:00-20:00
樊渊-2026华为软件挑战赛冠军
高手来了:看软挑高手解析二维排样问题—从工业难题到算法突破
回顾中
热门标签