- 别只盯着模型参数了:聊聊多模态时代最容易被忽视的一件事——训练数据准备 别只盯着模型参数了:聊聊多模态时代最容易被忽视的一件事——训练数据准备
- AI 会写稿了,人还要不要写?——聊聊生成式 AI 在数据增强与自动写稿里的伦理和质量问题 AI 会写稿了,人还要不要写?——聊聊生成式 AI 在数据增强与自动写稿里的伦理和质量问题
- 解密RAG:如何用检索增强生成突破大语言模型的遗忘之墙 摘要在人工智能领域,大语言模型(LLM)如GPT系列虽强大,却常因“遗忘之墙”而受限——无法实时更新知识或访问新数据。本文深入探讨检索增强生成(RAG)技术,揭秘其如何突破这一瓶颈。我将基于亲身项目经验,解析RAG的原理、应用场景及发展历程,并提供可落地的代码实现(使用LangChain和Hugging Face库)。通过架构图、性能... 解密RAG:如何用检索增强生成突破大语言模型的遗忘之墙 摘要在人工智能领域,大语言模型(LLM)如GPT系列虽强大,却常因“遗忘之墙”而受限——无法实时更新知识或访问新数据。本文深入探讨检索增强生成(RAG)技术,揭秘其如何突破这一瓶颈。我将基于亲身项目经验,解析RAG的原理、应用场景及发展历程,并提供可落地的代码实现(使用LangChain和Hugging Face库)。通过架构图、性能...
- 本文在LlamaFactory Online平台微调Chinese Tiny LLM - 2B小模型,通过困惑度筛选高质量中文语料,并设计三组中英配比实验。结果显示:微调后模型BLEU-4从11.34跃升至30.44,ROUGE指标全面领先。证明小模型经精细数据喂养,中文能力可媲美大模型,为算力受限团队提供轻量化落地路径。 本文在LlamaFactory Online平台微调Chinese Tiny LLM - 2B小模型,通过困惑度筛选高质量中文语料,并设计三组中英配比实验。结果显示:微调后模型BLEU-4从11.34跃升至30.44,ROUGE指标全面领先。证明小模型经精细数据喂养,中文能力可媲美大模型,为算力受限团队提供轻量化落地路径。
- MEaSUREs Multi-year Reference Velocity Maps of the Antarctic Ice Sheet V001简介该数据集是美国国家航空航天局(NASA)“为研究环境制作地球系统数据记录”(MEaSUREs)计划的一部分,包含三幅尽可能完整的南极冰盖速度镶嵌图,时间跨度分别为 1995–2001 年、2007–2009 年和 2014–2017 年。这... MEaSUREs Multi-year Reference Velocity Maps of the Antarctic Ice Sheet V001简介该数据集是美国国家航空航天局(NASA)“为研究环境制作地球系统数据记录”(MEaSUREs)计划的一部分,包含三幅尽可能完整的南极冰盖速度镶嵌图,时间跨度分别为 1995–2001 年、2007–2009 年和 2014–2017 年。这...
- 过去一年,全球 AI 行业几乎没有真正的“静默期”。OpenAI 连续发布多代 GPT,Anthropic 的 Claude 快速跻身第一梯队,Google Gemini 高速迭代。硅谷用百亿、千亿美金级别的投入,把大模型竞赛推向白热化。而就在这样的背景下,一家中国公司显得异常“安静”。据 金融时报 报道,DeepSeek V4 预计将于本周正式发布。距离 DeepSeek 上一次发布具有里... 过去一年,全球 AI 行业几乎没有真正的“静默期”。OpenAI 连续发布多代 GPT,Anthropic 的 Claude 快速跻身第一梯队,Google Gemini 高速迭代。硅谷用百亿、千亿美金级别的投入,把大模型竞赛推向白热化。而就在这样的背景下,一家中国公司显得异常“安静”。据 金融时报 报道,DeepSeek V4 预计将于本周正式发布。距离 DeepSeek 上一次发布具有里...
- DeepSeek 模型是近年来在自然语言处理(NLP)领域备受瞩目的开源大规模语言模型系列。其最新版本 DeepSeek-V3 采用了混合专家(Mixture-of-Experts,MoE)架构,拥有 6710 亿个参数,每个词元(token)激活 370 亿个参数。该模型在多项基准测试中表现出色,性能媲美 GPT-4 和 Claude 等领先的闭源模型。以下将详细介绍 DeepSeek 模... DeepSeek 模型是近年来在自然语言处理(NLP)领域备受瞩目的开源大规模语言模型系列。其最新版本 DeepSeek-V3 采用了混合专家(Mixture-of-Experts,MoE)架构,拥有 6710 亿个参数,每个词元(token)激活 370 亿个参数。该模型在多项基准测试中表现出色,性能媲美 GPT-4 和 Claude 等领先的闭源模型。以下将详细介绍 DeepSeek 模...
- 在机器学习领域中,过拟合(Overfitting)与欠拟合(Underfitting)是两个关键但相互对立的现象。理解这两种现象有助于构建更高效、更泛化的模型。下面我们将从理论、实际案例及代码示例等多角度进行探讨。 什么是过拟合?过拟合是指模型在训练数据上表现得非常好,但在新数据(测试集)上表现不佳。这表明模型过于复杂,捕捉到了数据中的噪声或非普遍模式,而这些模式并不能很好地泛化到其他数据。... 在机器学习领域中,过拟合(Overfitting)与欠拟合(Underfitting)是两个关键但相互对立的现象。理解这两种现象有助于构建更高效、更泛化的模型。下面我们将从理论、实际案例及代码示例等多角度进行探讨。 什么是过拟合?过拟合是指模型在训练数据上表现得非常好,但在新数据(测试集)上表现不佳。这表明模型过于复杂,捕捉到了数据中的噪声或非普遍模式,而这些模式并不能很好地泛化到其他数据。...
- 参考论文📜:Thermodynamic Simulation-assisted Random Forest: Towards explainable fault diagnosis of combustion chamber components of marine diesel engines, Measurement, 2025.为什么传统方案常常卡在工程现场?船用柴油机燃烧室故障诊断... 参考论文📜:Thermodynamic Simulation-assisted Random Forest: Towards explainable fault diagnosis of combustion chamber components of marine diesel engines, Measurement, 2025.为什么传统方案常常卡在工程现场?船用柴油机燃烧室故障诊断...
- 在人工智能领域,密集嵌入模型(Dense Embedding Models)是现代自然语言处理(NLP)系统中的核心技术之一。通过将高维的稀疏数据转化为低维的密集表示,这些模型显著提升了文本分类、信息检索和机器翻译等任务的性能。voyage-2 是一个典型的先进密集嵌入模型,其设计融合了多层深度学习架构与自监督学习技术,旨在捕捉语义信息的多样性与上下文依赖性。本文将详细解析 voyage-2... 在人工智能领域,密集嵌入模型(Dense Embedding Models)是现代自然语言处理(NLP)系统中的核心技术之一。通过将高维的稀疏数据转化为低维的密集表示,这些模型显著提升了文本分类、信息检索和机器翻译等任务的性能。voyage-2 是一个典型的先进密集嵌入模型,其设计融合了多层深度学习架构与自监督学习技术,旨在捕捉语义信息的多样性与上下文依赖性。本文将详细解析 voyage-2...
- 不是模型不行,是系统没喂饱:聊聊 openEuler 如何撑起“全自动 AI 训练优化” 不是模型不行,是系统没喂饱:聊聊 openEuler 如何撑起“全自动 AI 训练优化”
- 别再怪模型不聪明了:冷启动,本质是你“没喂饱”数据 别再怪模型不聪明了:冷启动,本质是你“没喂饱”数据
- 行车安全状态识别数据集(适用YOLO系列/1000+标注)(已标注+划分/可直接训练) 数据集分享链接链接:https://pan.baidu.com/s/1F27AXENPwYpHvu1JMbIdiw?pwd=dvmt提取码:dvmt 复制这段内容后打开百度网盘手机App,操作更方便哦 一、智能驾驶与交通安全的时代背景在智能驾驶与驾驶员辅助系统中,疲劳状态识别是确保行车安全的重要环节。通... 行车安全状态识别数据集(适用YOLO系列/1000+标注)(已标注+划分/可直接训练) 数据集分享链接链接:https://pan.baidu.com/s/1F27AXENPwYpHvu1JMbIdiw?pwd=dvmt提取码:dvmt 复制这段内容后打开百度网盘手机App,操作更方便哦 一、智能驾驶与交通安全的时代背景在智能驾驶与驾驶员辅助系统中,疲劳状态识别是确保行车安全的重要环节。通...
- 智能消防火焰检测数据集(适用YOLO系列/1000+标注)(已标注+划分/可直接训练) 数据集分享链接链接:https://pan.baidu.com/s/1AeZtk5eSvfgptp6Bkbu5kA?pwd=c4n4提取码:c4n4 复制这段内容后打开百度网盘手机App,操作更方便哦 一、智慧消防与公共安全的时代背景在人工智能和计算机视觉的快速发展中,火灾检测与火焰识别逐渐成为智慧城市... 智能消防火焰检测数据集(适用YOLO系列/1000+标注)(已标注+划分/可直接训练) 数据集分享链接链接:https://pan.baidu.com/s/1AeZtk5eSvfgptp6Bkbu5kA?pwd=c4n4提取码:c4n4 复制这段内容后打开百度网盘手机App,操作更方便哦 一、智慧消防与公共安全的时代背景在人工智能和计算机视觉的快速发展中,火灾检测与火焰识别逐渐成为智慧城市...
- 考场作弊检测数据集(适用YOLO系列/1000+标注)(已标注+划分/可直接训练)为了在考试、教育监考等场景中实现自动化监督与作弊行为识别,我们整理并构建了一个轻量易用的作弊行为检测数据集。该数据集包含真实考试视觉特征,可高效支持 YOLO、Faster R-CNN 等主流目标检测模型训练。 数据集下载链接:https://pan.baidu.com/s/1VBxTkGOjM5PWD7jw... 考场作弊检测数据集(适用YOLO系列/1000+标注)(已标注+划分/可直接训练)为了在考试、教育监考等场景中实现自动化监督与作弊行为识别,我们整理并构建了一个轻量易用的作弊行为检测数据集。该数据集包含真实考试视觉特征,可高效支持 YOLO、Faster R-CNN 等主流目标检测模型训练。 数据集下载链接:https://pan.baidu.com/s/1VBxTkGOjM5PWD7jw...
上滑加载中
推荐直播
-
华为云码道Agent集成与鸿蒙实战2026/08/11 周二 19:00-21:00
王一男-华为云码道产品规划专家;李炎-华为云码道产品专家;彭江敏-华为云鸿蒙端云一体化开发专家
本次直播带你解读华为云码道7月份产品新特性、新功能。更有专家演示码道Agent Space × 钉钉机器集成实战,从0到1打通消息通道;码道鸿蒙端云一体化实战,快速搭建员工签到系统。
回顾中 -
华为云开发者AI素养直播课·第五期2026/09/04 周五 16:00-18:00
林华鼎-华为云AI开发者运营负责人;蒋春阳-华为云AI开发者案例开发专家
本期直播内容: AI工具体验营 · 第5-8课连讲。Agent-Team 多智能体协作完成毕业设计实践
回顾中 -
华为云开发者AI素养ClassRoom·第六期2026/09/08 周二 19:00-20:00
樊渊-2026华为软件挑战赛冠军
高手来了:看软挑高手解析二维排样问题—从工业难题到算法突破
回顾中
热门标签