-
一、基本信息本文共计:1600+字,阅读时长:8~14分钟。本文将拆解具身智能领域的模型能力体系,清晰界定各层级、各类型模型的核心能力、功能边界,全面呈现各类模型如何协同支撑,具身智能体在复杂物理世界中完成自主决策与高效行动。 二、大脑层模型:具身智能的认知中枢,承载高层决策与场景理解 大脑层是具身智能体的认知决策核心,核心定位为:负责高层语义理解、环境认知、逻辑推理、全局任务规划与自然语言指令拆解,不直接参与底层运动控制、关节驱动与实时动作执行。类比人类大脑,核心职能是看懂环境、听懂指令、逻辑思考、拆解复杂任务,为整机系统输出全局决策方向与任务逻辑。 (一)大语言模型(LLM):具身智能的任务推理引擎 核心能力:涵盖人机自然语言交互、复杂长任务拆解、逻辑常识推理、多轮决策编排,可将人类生活化自然语言指令,转化为机器人可执行的结构化任务逻辑,同时应对开放场景的不确定性决策需求。从应用形态可分为通用基础大模型与具身专用微调大模型两大类别:经典模型:包括 LLaMA 系列、Qwen 系列、Vicuna、GPT-4o、Claude 等,具备极强的通用语言理解与逻辑推理能力,可完成多轮对话交互、子任务拆分、常识逻辑判断等基础认知工作,为具身智能提供通用知识与推理框架。前沿模型:以Embodied-LLM、具身专用微调 LLM、机器人端侧小参数量 LLM为代表,在通用大模型基座基础上,注入物理环境常识、机器人任务逻辑、空间交互规则等具身专属知识,强化复杂任务拆解的落地性与环境适配性,实现自然语言指令→任务逻辑→动作意图的平滑转换,弥补通用大模型在物理具身场景泛化不足的短板。 (二)视觉语言多模态模型(VLM):场景语义理解的感知桥梁 核心能力:视觉信息与语言语义跨模态融合对齐,实现复杂场景语义理解、开放词汇目标识别、环境场景语义标注,向上承接语言指令、向下输出结构化环境语义特征,搭建起视觉感知 — 语言理解 — 决策规划的关键桥梁。经典模型:包含 CLIP、FLAVA、ALIGN、Florence、BLIP 等,擅长实现图像与文本的双向匹配检索、通用物体与基础场景识别,可完成日常物体区分、基础空间语义理解,例如辨识杯子、餐具,理解 “桌子旁、沙发边” 等空间方位语义。前沿模型:以 EmbodiedGPT、Pelican-VL、轻量化具身专用 VLM、世界表征型 VLM 为代表,针对性强化动态复杂场景适配能力,可结合时序上下文完成场景语义推理;同时做端侧轻量化优化,适配机器人嵌入式部署需求,可自动识别厨房、客厅等专属场景,并理解对应场景下的作业意图。 (三)世界模型(World Model):物理环境交互的预判中枢 核心能力:学习真实世界物理运行规律,完成环境时空状态建模、未来场景时序预测、无交互虚拟推演与环境先验建模;可提前预判动态障碍物运动轨迹、自身动作带来的环境变化,为大脑高层决策提供物理规律依据,提升决策合理性与环境鲁棒性,是衔接大脑认知与小脑运动控制的关键中间层。技术架构:递归状态空间世界模型、Transformer 时空世界模型、JEPA 联合嵌入表征世界模型。经典主流以 Dreamer 系列(RSSM 递归状态架构)为典型,通过递归状态建模环境动态变化,实现短时序未来场景预测,预判物体运动、行人移动等基础动态行为。前沿模型:包括 Meta JEPA、Google Genie、ST-Transformer、具身专用时序世界模型,大幅提升长时序预测精度与复杂场景适配能力,支持多物体交互、光照变化、地形变化等复杂物理场景建模。 (四)视觉语言导航基础模型(VLN):语言驱动的空间决策向导 核心能力:自然语言指令到空间导航意图的转化,可理解 “直行、左转、绕行障碍物、前往指定点位” 等语义化导航指令,输出语义级空间路径意图,为导航规划提供高层语义指引,是大脑层负责空间认知与导航决策的专用模型。经典模型:以 Room-to-Room、REVERIE 为代表,主要适配室内结构化场景,可根据简单语言指令完成基础路径意图拆解与点位导航规划。前沿模型:包含 MobileVLA、LM-Nav 大模型导航分支,融合大模型深度语义理解与空间几何建模能力,适配室内外混合复杂场景,可解析长句、复杂约束类导航指令,同时支持动态环境下实时路径意图调整,导航泛化性与鲁棒性显著提升。
-
一、基本信息本文共计:1400+字,阅读时长:4~8分钟。本文主要介绍在具身智能领域下,具身智能数据采集的常见方式及相关介绍,通过对本文的阅读学习,能够帮助读者更全面、清晰的,了解到当下具身数采的相关知识。 二、具身数据特征具身数据不同于传统视觉数据集或语音语料数据,它是具身机器人与环境交互过程中产生的全状态时空序列数据,是具身机器人在真实物理世界稳定运行的核心基础。其具备以下常见的典型特征:1. 多模态耦合:视觉、深度、力觉、触觉、关节位置、力矩、本体姿态等多维度信息高度绑定、协同互补,而并非简单叠加,可解决单一模态数据的局限性,为机器人精准决策提供支撑;2. 物理闭环:机器人动作与环境物理交互形成“动作输出—反馈采集—动作调整”的完整闭环,包含接触、碰撞、滑移、夹持力、物体形变等真实物理反馈;3. 长时序连续:从原子操作到复杂任务,数据采集保持时间连续、状态完整,支撑模型学习完整任务逻辑与动作关联,是具身机器人实现复杂任务自主执行的前提;4. 强对齐性:所有传感器必须在统一时空坐标系下严格同步,是多模态数据协同作用、模型准确理解交互关系的基础。可以说,没有高质量具身数据,再强大的模型架构也难以在真实物理世界中稳定运行。5. 噪声固有性:具身数据在采集过程中,受传感器、环境、交互随机性影响,会天然包含噪声,这种噪声固有性并非缺陷,反而使得具身数据更贴近真实物理世界的状态,可帮助模型提升抗干扰能力。 三、具身数采路线当前行业形成了四条相对成熟、互补共存的数据采集技术路线,分别是:真机遥操作采集、人类动作捕捉采集、仿真合成数据、互联网视频与弱监督学习,各自在精度、成本、效率上存在显著差异。数据采集方式核心原理子类型&代表方案优势点劣势点场景匹配真机遥操作采集(Teleoperation)通过穿戴/手持设备,遥控机器人本体,同步记录机器人全状态交互数据同构遥操:人形/灵巧手操控同款机器人穿戴式外骨骼:全身/手部力反馈手套 数据精度最高,含关节位姿、力矩、力触觉、6DoF、视觉全模态 可直接落地,同机型零迁移训练成本高、效率低 强绑定机器人本体,跨机型复用率低适合高精度工业装配、医疗操作、精密组装,以及机型量产前最终微调无本体便携采集通过普通人用手机 + 低成本夹爪 / 动捕设备,在真实场景中 采集,无需机器人本体手持 UMI:通用夹爪+第一视角相机/手机+机械连杆轻量、成本极低、场景无限、规模化最快缺乏力觉 / 触觉、精度中等、数据质量参差。适合居家家务、办公桌面、商超零售、等碎片化、生活化强的场景人类动作捕捉(Motion Capture)采集真人自然操作数据,再映射到机器人关节空间光学动捕:红外相机阵列光惯融合:IMU+视觉穿戴式感知手套:角度编码器+触觉阵列动作自然、覆盖长尾场景 轻量、采集场景多样 缺失力 / 触觉、物理交互信息 人体与机器人之间存在映射畸变适合家庭服务、商超物流、日常操作,以及通用技能预训练仿真合成数据(Sim-to-Real)在虚拟引擎中生成海量机器人交互数据仿真平台:cloudrobo、NVIDIA Isaac、Unity、Gazebo、智元 AGIBotWorld零边际成本、可规模化至百万小时级 环境可控、全状态可观测 物理精度不足(柔性、摩擦、碰撞),存在Sim-to-Real Gap 真实环境泛化性差适合策略预热、环境探索、危险 / 极端场景训练,不适合最终落地验证互联网视频与弱监督学习从海量人类操作视频中反解动作、意图与语义知识公开视频数据集、 网络教学视频爬取近乎零成本、场景极度丰富 无力觉、精确时序、轨迹标签 数据噪声大、利用率低适合语义理解、常识学习、提升泛化能力,无法用于底层控制
-
一、基本信息本文共计:1600+字,阅读时长:5~9分钟。本文主要介绍在具身智能领域下,具身数据的常见分类、数据瓶颈及相关介绍,通过对本文的阅读学习,能够帮助读者更全面、清晰的,了解到当下具身数据的相关知识。 二、具身数据具身智能是一个感知-决策-执行-反馈-迭代的闭环数据流系统,从单机器人实验到规模化部署,数据流的完整性、实时性、标准化,直接决定智能体能否真实落地、泛化以及持续进化。具身智能所需要的数据,不是简单的“文本+图片+视频+动作”组合,它更需要的是全维度的、多模态的、时空对齐的、真实反馈的复杂信息集合,涵盖了视觉、听觉、触觉、动作、环境交互等多个维度。按照数据的来源与真实性,可以分为两大类:真实物理世界的交互数据、虚拟仿真环境的模拟数据。从感知多模态的角度,还可以细分为五类核心数据。简单类比人类婴儿的探索学习期,即为:眼睛看(视觉)、耳朵听(听觉)、手指触(触觉)、肢体动(力觉)、头脑思(记忆)的全链路覆盖。 数据维度数据定位类比硬件设备数据内容数据作用真实物理数据视觉感知数据智能体的“眼睛”,环境感知基础眼睛摄像头、激光雷达、深度相机等RGB图像、深度视频、3D点云、第一人称视角画面等识别物体位置、大小、判断距离、理解场景布局本体状态数据智能体的“身体感知”,自我状态监控肢体惯性传感器、编码器关节角度、电机电流、速度、力矩、位置坐标控制动作精准度,防止摔倒/碰撞触觉/力觉数据智能体的“皮肤”,精细交互核心皮肤电子皮肤、触觉传感器压力、滑觉、摩擦力、六维力反馈决定精细操作能力,是通用机器人关键动作轨迹数据智能体的“行为记忆”,任务执行路径小脑动捕设备、遥操设备遥操作示教、动捕采集的完整运动轨迹复刻人类操作,快速学习复杂任务语音/文本指令数据智能体的“耳朵”,人机交互入口耳朵麦克风语音命令、任务描述、语义标签增强交互自然,适配日常场景虚拟仿真数据合成视觉/场景数据低成本预训练素材,补充真实数据不足模拟器/虚拟环境渲染图像、极端场景(暴雨/黑暗)合成画面扩充数据集,训练鲁棒性仿真动作/交互数据大规模基础能力训练“题库”模拟练习/虚拟机器人抓取、搬运、避障的模拟数据快速试错,优化运动算法互联网视频迁移数据低成本行为参考库学习教程/人类日常操作视频、开源动作数据集学习人类行为模式,降低采集成本 三、数据瓶颈 1.异构本体导致数据孤岛,使得跨本体复用性差不同构型的机器人(轮式、人形、四足),其传感器布局、关节自由度、控制接口等硬件差异显著。使得采集的数据好似自带“本体烙印”,难以跨本体迁移和复用,这直接构成了数据共享与复用的巨大障碍。2.数据采集环节的成本高昂真机数据是高质量训练的数据基石,但总量远不及数字世界。具身智能所需要的数百PB级物理交互数据,存在巨大的数据缺口。在此背景下,真机数据采集的成本反而高居不下。赛迪智库分析报告指出,当下单台设备产生1万小时训练数据,甚至需要消耗上百万元。同时,人员成本也居高不下,一个数采员一天只能采集300~500条数据,面对复杂任务时产出更低。3.Sim2Real的鸿沟显著,仿真数据迁移受限物理引擎无法精准模拟接触、摩擦、柔性物体的形变等真实特性,仿真数据与现实环境之间存在GAP,限制了模型迁移效果。训练模型在真实场景性能衰减明显,仿真数据的泛化能力有限,难以覆盖非结构化、动态开放环境,出现“最后一公里”的落地难题。4.数据质量与评估体系的缺失,使得规模化落地困难数据质量(信噪比、时空对齐精度、因果链完整性)参差不齐,缺乏标准化评估指标与认证体系。无论是数据采集的格式、标注的标准、评测框架,还是数据质量的评估,都缺乏统一的标准。使得不同模型结果难以横向对比,阻碍技术迭代与规划化应用。5.隐私与安全风险突出,合规问题暴露多模态数据采集过程中,极易过度收集人脸、声纹等敏感信息,时空关联后可构建出精细的个人画像,对个人隐私的泄露造成巨大的风险。同时,在公共场所运行数据采集时,造成对第三方数据的无意采集,也容易产生不可预见的风险。
-
本文共计:3300+字,阅读时长:14~18分钟。一、前言:阅读定位与核心价值本文聚焦具身智能进阶攻坚阶段两本核心书目:《具身智能原理与实践》《具身智能数据工程:标准、技术与实践指南》。面向已完成3本入门书籍(《具身智能》刘云浩版、《具身智能:从理论到实践》、《具身智能导论》)学习,具备具身智能基础认知、理论体系和基础技术应用能力的读者,为入门后的进阶学习提供清晰指引。核心定位:适配从“入门开发者”向“进阶开发者”转型的学习者,遵循“先夯实底层原理与核心技术→再补齐数据工程短板”的进阶逻辑,两本书各有侧重、相互支撑,形成“原理攻坚+数据落地”的完整进阶知识闭环,帮助学习者突破入门瓶颈,掌握具身智能核心技术与工程落地能力,为后续项目开发、技术深耕奠定坚实基础。阅读顺序:《具身智能原理与实践》→《具身智能数据工程:标准、技术与实践指南》二、核心书籍阅读推荐与内容详解(一)第一本:《具身智能原理与实践》 作者:林倞、张瑞茂、吴贺丰 | 出版社:电子工业出版社 | 出版时间:2024.121. 阅读推荐(适配性+优先级)优先级:★★★★★(进阶攻坚必看、技术内核核心书目)适配人群:已读完入门三本读物,具备具身智能基础概念、机器人基础、基础技术应用能力;想要深入拆解具身智能感知-决策-控制全链路底层原理的个人开发者;希望掌握三维视觉、NeRF、具身强化学习、大模型具身赋能、多智能体协同的进阶开发者;需要依托仿真平台做算法复现、项目自研的独立开发者;想往具身算法、机器人自主规划方向深耕的技术学习者。推荐理由:2025年全新出版,紧跟VLA大模型、三维具身、仿真训练等行业前沿;由IEEE Fellow(中山大学)权威专家编写,理论严谨、体系完整,具备极高的技术权威性;区别于入门书的浅度科普,直击底层原理+工程实践双维度,既讲“为什么”,又讲“怎么做”;不堆砌冗余复杂公式,侧重原理拆解、算法逻辑、平台实操,兼顾专业性与可读性;适配个人开发者无团队、无高端硬件的自学场景,依托通用仿真环境即可复现书中案例,是从入门走向专业研发的关键过渡书籍,完美承接入门阶段知识。2. 书籍内容介绍本书以8章完整系统化章节架构,自上而下拆解具身智能完整技术栈,打通大模型、三维视觉、强化学习、机器人控制、仿真部署之间的关联,兼顾原理溯源与工程落地实操,帮助个人开发者建立专业级具身智能技术体系,突破入门阶段的技术瓶颈,实现技术能力的进阶升级。核心章节与重点内容:● 基础进阶篇:升级具身智能底层范式,对比传统AI与具身AI的核心差异,详解脑-身-环境交互机理、大模型赋能具身智能的底层逻辑、VLA(视觉语言动作模型)基础架构,衔接入门阶段的核心知识点并做深度拔高,为后续技术攻坚奠定坚实基础。● 核心技术原理篇:本书核心章节,详细拆解六大核心技术模块——三维视觉(NeRF技术,重点讲解场景重建、实时渲染的原理与实操)、具身强化学习(具身场景下的强化学习算法设计、训练技巧,解决环境交互中的决策问题)、复杂场景SLAM(进阶版即时定位与地图构建,适配复杂动态场景)、机器人路径规划与避障(高阶算法设计,提升复杂环境下的导航稳定性)、多模态感知融合(视觉、雷达、IMU等多传感器数据融合逻辑与实操)、大模型具身赋能(VLA模型微调、提示词工程进阶),每个技术点均搭配底层原理解析、公式简化解读(避免过度复杂)和实操步骤,让个人开发者能吃透原理、学会应用。● 仿真与平台实践篇:基于英伟达仿真生态,详细讲解仿真环境搭建、虚拟场景构建、智能体训练闭环、模型微调与验证的完整流程,解决个人开发者缺少实体机器人硬件的学习痛点,提供低成本的实操方案,让开发者无需真机即可完成算法复现与项目验证。● 多智能体与落地篇:讲解多具身智能体协同机制、任务分配、交互决策逻辑,配套工业、家用服务机器人典型实战案例,给出技术选型、方案设计、代码落地的完整思路,帮助个人开发者将所学技术转化为实际项目能力,实现从理论到工程落地的跨越。核心亮点:技术体系完整、深度适中不晦涩,兼顾学术原理与工程落地,避免“纯理论难落地”“纯实操无深度”的问题;把零散的具身知识点串联成完整技术链路,帮助开发者建立系统化认知;仿真实操友好,适配个人开发者独立学习场景,无需高端硬件即可上手;内容前沿,覆盖当前具身智能核心技术热点,帮助开发者紧跟行业趋势,为后续数据工程、项目自研打下坚实的算法根基。(二)第二本:《具身智能数据工程:标准、技术与实践指南》 作者:夏轩、俞波、刘少山 | 出版社:人民邮电出版社 | 出版时间:2025.71. 阅读推荐(适配性+优先级)优先级:★★★★★(进阶工程必看、数据体系标杆书目)适配人群:已经掌握具身智能算法原理,卡在数据稀缺、数据集难构建、真实仿真数据割裂问题上的个人开发者;想要学习多模态数据采集、清洗、标注、对齐、Sim2Real迁移的工程型开发者;计划自建具身数据集、做小模型微调、定制化具身任务开发的独立开发者;从事机器人、具身智能体研发,需要建立数据工程规范与流程的学习者;希望解决“算法会用,但没有数据支撑落地”痛点的进阶开发者。推荐理由:2025年7月新出版,是国内首部专门聚焦具身智能数据工程的专著,填补市面上只讲算法、不讲数据全链路的空白;由AIRS具身智能中心核心团队(夏轩、俞波、刘少山)撰写,完全贴合工业界真实开发流程,实操性极强;从行业标准、技术流程、工具链、实战案例四个维度,系统讲解具身智能数据全生命周期工程,完全适配个人开发者自建数据集、低成本做具身模型训练的需求;基于AIRSPEED开源项目,配套完整可复用的工程流程,学完即可应用到个人项目中,实用性拉满。2. 书籍内容介绍本书聚焦具身智能数据全生命周期工程,以“标准+技术+实践”为核心,系统讲解如何低成本、高质量构建具身智能数据集,解决行业普遍存在的数据量不足、质量差、Sim2Real迁移难、标注成本高等核心痛点,为具身智能算法落地提供坚实的数据支撑,衔接《具身智能原理与实践》的算法知识,形成“算法+数据”的完整进阶体系。核心章节与重点内容:● 数据工程基础篇:定义具身智能数据类型(视觉、雷达、IMU、动作数据等)、行业规范与质量评价标准,梳理多传感器数据的核心特征与采集要求,建立具身数据工程的整体认知框架,让开发者明确“什么是合格的具身数据”“数据工程的核心流程是什么”。● 数据采集与构建篇:详解真实物理场景数据采集方案(低成本采集设备选型、采集流程、数据同步方法)、仿真环境自动化数据生成策略(基于主流仿真平台,批量生成标注数据)、多模态数据同步与时间对齐技术,适配个人开发者低成本自建数据的实操方案,降低数据采集的门槛与成本。● 数据处理与标注篇:讲解具身智能专属的数据清洗、去噪、帧筛选方法,重点介绍半自动标注、弱监督标注技巧,降低人工标注成本,解决个人开发者“标注工作量大、效率低”的痛点,同时讲解标注数据的质量校验方法,确保数据集的可用性。● Sim2Real与迁移工程篇:本书核心亮点章节,重点讲解仿真域到真实域的数据迁移、域自适应、数据增强策略,解决仿真训练模型无法落地真机的核心难题,给出具体的迁移流程与实操技巧,帮助个人开发者实现“仿真训练→真机落地”的闭环。● 项目实战与开源落地篇:基于AIRSPEED开源项目,配套完整的工程流程、工具链使用教程、数据集封装方法、模型训练数据闭环案例,每个步骤都清晰可操作,个人开发者可直接复用流程与方法到自己的项目中,快速实现数据工程的落地应用。核心亮点:定位稀缺,是具身智能数据工程领域从入门到精通的为数不多的系统读物,填补行业知识空白;不讲空泛理论,全是工业界真实工程流程、实操方法、可落地规范,实用性极强;兼顾个人开发者低成本方案与工业级标准,既适合个人自学,也能为后续职业发展提供规范指导;学完可独立完成从采数据、做标注、建数据集到模型训练的数据全链路,完美解决具身智能落地的核心数据瓶颈。三、后续衔接建议读完整套5本核心书籍(入门3本+进阶2本)后,个人开发者已具备具身智能入门认知+理论基础+智能体开发+底层算法原理+数据工程全链路能力,基本达到专业级具身智能研发入门水平。后续可继续研读国外经典英文专著、ICRA/IROS/CoRL等顶会论文,深入学习ROS2高阶开发、VLA大模型微调部署、复杂场景多智能体协同等内容,进一步提升技术深度与行业视野,稳步向专业级具身智能研发开发者、算法工程师转型。
-
本文共计:3500+字,阅读时长:14~18分钟。一、前言:阅读定位与核心价值本文聚焦具身智能入门期核心书单,整合3本核心读物——《具身智能》(刘云浩 著)、《具身智能:从理论到实践》、《具身智能导论》,面向零基础、想入门具身智能的个人开发者、转行从业者、高校学生及科技爱好者,明确每本书的阅读优先级、适配场景与核心价值,拆解书籍内容与学习重点,帮小白快速找到适合自己的入门路径。核心定位:适配具身智能零基础/入门级学习者,遵循“先建立全局认知→再入门技术实操→接着夯实理论基础”的科学学习逻辑,3本书各有侧重、相互衔接、层层递进,形成完整的入门知识闭环,帮助入门者避开盲目阅读,高效搭建具身智能基础体系,为后续技术攻坚、项目落地奠定坚实基础。阅读顺序:《具身智能》(刘云浩)→《具身智能:从理论到实践》→《具身智能导论》二、核心书籍阅读推荐与内容详解(一)第一本:《具身智能》 作者:刘云浩 | 出版社:中信出版社 | 出版时间:2025.011. 阅读推荐(适配性+优先级)优先级:★★★★★(入门首选·通识奠基必读书目)适配人群:完全零基础、想转行学习AI/具身智能的小白;非工科背景,想系统搞懂“具身智能是什么、为什么火、未来发展方向”的学习者;AI产品、行业研究、创业从业者,需要把握具身智能产业趋势;准备系统学习后续专业技术书籍,需要先搭建基础认知框架的入门读者。推荐理由:2025年1月最新出版,紧跟当下大模型、人形机器人、具身AI的最新行业趋势,内容不滞后、有前瞻性;作者刘云浩是清华大学资深教授、智能系统领域顶级专家,内容严谨不浮夸,既有学术高度,又能贴合小白认知;定位是通识科普,不讲复杂公式、不堆砌代码,专门帮小白建立“什么是具身智能、为什么它是AI下一个发展方向”的基础认知;读完这本书再看后面两本专业技术书,能轻松听懂专业术语、理解技术背后的逻辑,大幅降低后续阅读难度。2. 书籍内容介绍本书站在人工智能发展的全局视角,梳理AI从传统“离身智能”(只在虚拟世界运算,不接触物理世界)到大模型,再到“具身智能”(有物理身体,能在真实世界互动)的完整发展过程。跳出“具身智能就是人形机器人”的误区,从思想起源、理论逻辑、技术脉络、产业应用、未来趋势五个方面,用通俗的语言拆解具身智能的本质:智能体拥有物理身体,能在真实环境中感知、互动、学习、进步,打通大模型从“纯文本虚拟智能”走向“物理世界落地应用”的核心逻辑。全书语言通俗、结构清晰,兼顾历史回顾、原理解读与行业预判,是小白入门具身智能的最佳启蒙读物。核心章节与重点内容:● AI演进脉络梳理:回顾符号主义、联结主义、行为主义三代人工智能的兴衰与不足,讲清传统AI和大模型的天生局限,让小白理解具身智能诞生的行业背景和必要性。● 范式变革核心逻辑:详细解析“离身智能”的短板(比如无法感知真实世界、不会灵活互动),说明具身智能诞生的必然性,纠正“具身智能=人形机器人”的认知误区,明确具身智能的核心定义。● 具身智能底层原理:用通俗的语言讲解“身体、环境、感知、认知、决策、行动”的闭环逻辑,不用复杂公式,小白也能看懂具身智能的底层运作机理,建立基础认知框架。● 关键技术全景概览:对多模态感知、环境交互、学习进化、大模型赋能具身等核心技术方向做全面介绍,帮助小白建立初步的具身智能技术认知,不用深入钻研细节。● 产业落地与未来展望:介绍具身智能在人形机器人、智能制造、家庭服务、智慧城市等领域的应用场景,分析行业机遇、技术瓶颈与长期发展趋势,拓宽小白的行业视野。核心亮点:入门门槛极低,没有数学公式、不需要专业前置知识,小白能从头到尾顺畅读完;格局宏大、体系完整,不只是讲技术,还会讲行业思想、发展范式,帮小白建立具身智能的顶层认知;权威且时效性强,2025年初新作,贴合当前行业最新动态,观点有长期参考价值;承上启下作用突出,作为入门第一本,能为后续专业技术书籍做好认知铺垫,让小白学习技术时不突兀、能跟上。(二)第二本:《具身智能:从理论到实践》 作者:易显维、吴凯 | 出版社:清华大学出版社 | 出版时间:2025.101. 阅读推荐(适配性+优先级)优先级:★★★★★(入门核心·技术实操破冰书目)适配人群:已读完《具身智能》(刘云浩版),对具身智能有了全局认知的小白;完全零基础、想快速入门具身智能技术,希望兼顾“理解理论+动手实操”,不想只看纯理论的读者;需要快速搭建具身智能基础技术框架,为后续深入学习打基础的开发者。推荐理由:2025年10月最新出版,内容贴合当前具身智能技术前沿,作者是一线技术专家,避开晦涩难懂的纯学术表述,用“理论+代码”结合的方式,降低小白的入门门槛;覆盖具身智能核心基础知识点,衔接前一本书的通识认知和后一本书的理论内容,是入门期的“桥梁型”书籍,阅读难度低、实操性强,是小白技术入门的核心读物。2. 书籍内容介绍本书以AI发展脉络为切入点,打破“理论与实践脱节”的问题,系统讲解具身智能的核心定义、发展历程,以及入门必备的核心技术,全程配套完整可复用的代码实践,让小白能边学边练、快速上手,顺利实现从“通识认知”到“技术入门”的过渡。核心章节与重点内容:● 基础认知篇:拆解具身智能与传统AI的区别,讲解具身智能“脑-身-环境”协同的核心逻辑,通俗解读VLA(具身大型语言模型)的基本原理,衔接前一本书的通识内容,让小白快速衔接技术层面的认知。● 核心技术篇:重点讲解入门必备的技术,包括SLAM(即时定位与地图构建)、多传感器融合、ROS2(机器人操作系统)、视觉语言导航(VLN),每个技术点都搭配简单易懂的原理解析,不堆砌复杂公式,重点讲“是什么、怎么用”,贴合小白认知。● 实践操作篇:配套完整可复用的代码,基于常见的开发工具,讲解简单具身智能场景的实操案例(比如简单机器人导航、视觉感知),步骤清晰,小白可直接跟着操作,快速实现“从理论到实践”的落地,建立学习信心。核心亮点:兼顾通俗性与实操性,知识点覆盖全面,衔接前后书籍内容,是入门期小白最易上手、性价比最高的技术入门书籍;代码案例可直接复用,降低小白的实操门槛;能帮助小白快速建立具身智能的技术认知,避免“入门即放弃”的困境。(三)第三本:《具身智能导论》 作者:刘华平、郭迪、孙富春 | 出版社:高等教育出版社 | 出版时间:2024.101. 阅读推荐(适配性+优先级)优先级:★★★★★(入门核心·理论夯实书目)适配人群:已读完《具身智能》(刘云浩版)和《具身智能:从理论到实践》,对具身智能有初步认知和简单技术基础,需要夯实理论基础的小白;希望深入理解具身智能核心机制,不只想单纯掌握实操技巧的读者;后续想向技术深度方向发展,需要完善理论体系的开发者。推荐理由:由高校权威团队(刘华平、郭迪、孙富春)撰写,理论权威性强,内容系统严谨,重点弥补前两本书的理论深度不足;2024年10月出版,内容贴合当前技术趋势,不滞后;以“导论”为定位,结构清晰,侧重讲解具身智能的体系结构与核心原理,为小白后续进阶学习奠定理论基础,是入门期“理论拔高”的核心书籍。2. 书籍内容介绍本书聚焦具身智能的理论体系,系统梳理具身智能的内涵、体系结构与发展趋势,避开复杂的工程化实操,重点讲解“为什么这么设计”“核心机制是什么”,帮助小白从“知道怎么用”(知其然)走向“知道为什么这么用”(知其所以然),实现从“技术入门”到“理论夯实”的提升。核心章节与重点内容:● 体系结构篇:详细讲解具身智能的整体架构,拆解感知、决策、执行三大模块的协同逻辑,分析“脑-身-环境”三者的交互机制,让小白理解具身智能系统的核心构成,衔接前一本书的技术知识点。● 核心原理篇:重点讲解形态计算、视觉导航、主动感知、具身学习与多智能体协同的核心原理,结合简单实例(比如机器人主动避障、多机器人协同作业),让抽象的理论变得易懂,避免纯学术化表述,贴合小白认知。● 发展趋势篇:梳理具身智能的当前挑战、技术突破方向,介绍行业前沿应用场景(比如服务机器人、工业机器人),帮助小白拓宽行业视野,明确后续学习重点,为进阶学习做好铺垫。核心亮点:理论体系完善,权威性强,难度适中,紧密衔接前两本书的内容,侧重理论深度,帮助小白夯实基础,避免“只会用、不懂原理”的问题;是入门期“理论夯实”的关键书籍,能为小白后续进阶学习筑牢理论根基。三、后续衔接建议读完这三本核心入门书籍后,小白已具备具身智能的基础认知、理论体系和基础技术应用能力,顺利完成从“小白”到“入门开发者”的转变。后续可无缝衔接进阶两本核心书籍:《具身智能原理与实践》《具身智能数据工程:标准、技术与实践指南》,进入技术攻坚与数据工程实战阶段,进一步实现实践落地,向具身智能进阶开发者转型。
-
实操案例介绍什么是JiuwenSwarmJiuwenSwarm是基于openJiuwen智能体开发平台打造的个人专属 AI 助理,JiuwenClaw 的核心使命是「懂你所想,自主演进」。针对你的各种复杂输入场景,如任务追加、打断、修改等,把各类需求排出优先级,并有条不紊地完成,做你的贴身任务管家;同时它也能在你身边自主演进,当你对它表达不满或运行出错时,它会根据你的反馈自动调整相应技能,全心全意为你服务。实操内容概述本案例将指导开发者从零开始,完成JiuwenSwarm的安装,并使用technical-blog-generator技能输出一篇小红书推文。全程约5-10分钟,开发者将完整体验AI智能体辅助办公的全流程。应用场景在办公场景中,宣传推文编写是常见需求,但传统方式需要耗费大量时间进行资料收集、内容编排。本案例基于小红书宣传短文这一典型场景,演示如何借助AI智能体实现宣传短文的自动化生成,大幅提升宣传效率。解决的问题效率问题:传统宣发推文制作耗时耗力,资料调研往往需要数小时甚至数天内容问题:缺乏专业资料支撑,内容空洞或存在信息偏差开发者收获完成本案例实操后,开发者将获得:1. 一份可直接使用的小红书宣发流程:指定主题,自动完成小红书推文撰写与发布2. AI办公思维:理解智能体辅助办公的工作模式,可迁移到其他文档生成场景3. 效率提升认知:体验AI赋能办公的价值,为后续深度使用奠定基础前置准备Windows 10/11操作系统MaaS服务API Key,文本生成和图片生成华为云MaaS平台大模型Tokens福利领取:1)方式一:登录华为开发者空间,参考案例《华为开发者空间 - ModelArts Studio大模型通用代金券领取使用指导》中的“二、 开通MaaS平台大模型”章节内容领取代金券,下述案例以配置glm-5.1和qwen-image为例,建议在此开通这两个模型,获取相关的API地址、模型名称和API Key,并保存好。2)方式二:登录华为开发者空间,参考案例《华为云MaaS平台大模型Tokens领取使用指导》中的“二、 领取MaaS平台大模型Tokens”章节内容,领取MaaS平台DeepSeek V3系列大模型Tokens代金券,购买ModelArts Studio DeepSeek Tokens套餐包,开通模型服务,最后获取到模型的API地址、模型名称和API Key。 实操步骤一、下载JiuwenSwarm客户端1.访问JiuwenSwarm产品页面:cid:link_5。2.选择“Windows”平台,点击“立即下载”按钮,下载安装包。3.安装包名称:“JiuwenSwarm-setup-0.2.0.exe”(版本号可能更新)。二、安装JiuwenSwarm1.双击下载的安装包启动安装程序,并根据提示完成安装。2.建议安装目录使用默认路径。3.建议使用默认配置安装。三、完成JiuwenSwarm配置1.打开JiuwenSwarm客户端,点击左边侧栏“配置信息”。2.完成主对话模型配置和视觉模型配置,本次案例使用的华为云ModelArts平台中提供MaaS服务,主对话模型使用glm-5.1,视觉理解模型选择qwen-image,参考配置方式如下:3.主对话模型具体配置信息:4.视觉模型具体配置信息:5.完成配置后,切记点击右上角的“保存”按钮,若未保存,需要重新执行上述步骤配置MaaS服务。四、安装technical-blog-generator技能1.点击左边侧栏的“技能”,并选择“技能广场”→“SwarmSkills在线检索”。2.在搜索栏中输入“technical-blog-generator”,并点击“安装”按钮。3. technical-blog-generator技能已在SwarmSkillsHub上发布,可以访问cid:link_4查看具体内容。五、使用配置技能生成小红书宣传短文1.在JiuwenSwarm对话窗口选择“规划模式”,并在输入框填入指令,如“帮我生成一篇介绍swarm skills hub的小红书推文”,还可输入其他主题或场景的指令,比如“帮我生成2篇养生/健身相关的小红书推文”。2. JiuwenSwarm创建Todo列表并依次执行任务,可查看具体流程:1)执行信息检索,获取相关信息,提取关键信息,形成参考清单。2)分析内容并判断帖子类型与配图策略。3)生成小红书宣传短文初稿。4)文本质量审查和事实自检。5)生成配图文案。3.用户二次确认:确认文本初稿、配图是否符合预期,不符合预期则输入指令进行修改。4.可在输入框发送“刚才生成的图片和小红书帖子的位置在哪里”获取最终生成的图片、小红书初稿等文件存放地址(一般存放于“C:\Users\用户名\.jiuwenswarm\agent\workspace”), 用户将图文复制粘贴到小红书创作平台(https://creator.xiaohongshu.com/),完成发布。部分过程如下:5.注意事项:默认会调用“task_tool”派生子agent的方式来完成信息收集,此方式效果好但耗时较长,在时间、资源受限场景,可以采用更轻便的方式,即直接调用信息收集的相关工具来完成,只需要在输入指令时,加一句“不要使用子agent来执行任务”,比如上述案例需要改为“帮我生成一篇介绍swarm skills hub的小红书推文,不要使用子agent来执行任务”。 进阶体验1 多篇小红书量产:上述内容是发布单篇帖子的示例,此外,也支持同时发布多篇小红书推文,比如输入“从openJiuwen社区查找coordination engineering相关的博客,帮我分别生成3篇小红书博文,主题依次为Swarm team(Agent team)、Swarm Skill、Swarm Skill自演进”,效果如下图所示: 进阶体验2 多智能体五子棋对弈:在输入框下方选择“集群模式”开启多智能体协作范式,输入“创建2人团队,模拟两个人下五子棋,为双方分别创建一个下棋任务,决出胜负后完成任务,双方直接通过对话下棋,每步必须在消息中输出棋盘,我要实时看到棋局,两人专注下棋对其他消息静默处理”,效果如下图所示: 案例总结通过本案例实操,我们体验了基于JiuwenSwarm自动生成小红书宣传推文,完整流程包括:步骤功能说明下载安装一键部署无需配置环境,快速上手配置主对话模型,视觉模型自定义大模型服务需要准备大模型服务的API Key输入指令前端输入框直接输入需要说明宣传推文主题,参考对象信息(可选)登陆小红书,并发布帖子用户验证与笔记发布小红书笔记发布JiuwenSwarm核心优势1. 多智能体协同:基于Swarm Team、Swarm Skill、Swarm Skill Hub、Swarm Skill自演进,构建完善协同工程体系,实现“单智能体好用-多智能体协同-团队能力沉淀-团队能力演进”的完整闭环。2. 任务自主管理:用户可以随时对任务进行动态打断、追加和修改。任务执行过程中,实时展示当前任务状态,中途打断或追加,也可以灵活地重新规划与更新任务列表,不必等待前述任务完成。3. Skills自主演进:基于openJiuwen自演进框架,支持Skills自主演进。比如某次工具调用失败,或者用户说了“不对”、“换个方式”,系统会主动记录这些执行错误和反馈,分析根因,生成针对性的改进建议。同时,会向用户弹出演进审批窗口,所有更新由用户自己决定。4. 上下文压缩和卸载:通过上下文卸载(Context Offload)机制,有效节省成本,同时支持实时展示当前上下文状态,用户可以清晰看到压缩前后的上下文长度和压缩比。5. 记忆随行:通过分层持久化记忆系统,实现身份、场景、操作轨迹的全维度长效存储与智能检索,保障跨会话交互的连贯与精准。参考链接openJiuwen官网:cid:link_6JiuwenSwarm项目地址:cid:link_3JiuwenSwarm项目文档:cid:link_5【训练营小tip】如您在案例实操过程中遇到问题或有改进建议,可以在开发者训练营群内反馈,我们会及时响应处理,谢谢!欢迎扫码,加入华为云Inspire创想者大会实战训练营技术交流群扫码获取更多训练营资讯
-
为什么训练作业中使用os.system('cd xxx')无法进入相应的文件夹呢
-
## EI企业智能2022年7月高热贴合集 以下是EI企业智能板块在2022年7月份的高热贴的合集,虽然今年的三伏天已热的突破历史,但本月AI开发平台ModelArts、数仓GaussDB(DWS)板块的热度更高。 另外板块名称有一些小小的修改,比如 **ModelArts** 改为了 `AI开发平台ModelArts` **HiLens** 改为了 `华为HiLens & ModelBox` 新名称新气象啊~ ## 数仓GaussDB(DWS) GaussDB 8.0.0.1版本 巡检工具806,互信中提到的sshTool.sh文件从哪里获取?https://bbs.huaweicloud.com/forum/thread-193193-1-1.html autovacuum如何配置可以实现定时全库全表analyse?https://bbs.huaweicloud.com/forum/thread-193348-1-1.html 【DWS】【sql】pg_stat_user_functions 为什么没有数据:https://bbs.huaweicloud.com/forum/thread-193726-1-1.html dws中sql在执行Streaming(type: REDISTRIBUTE)之前先进行HashAggregate是否能提升性能:https://bbs.huaweicloud.com/forum/thread-193978-1-1.html 【GaussDB 8.1.1】【Oracle的months_between函数迁移】Oracle函数迁移效率不行:https://bbs.huaweicloud.com/forum/thread-193925-1-1.html gaussdb如果查询所有表名及主键字段名称?或者如何查询单表的主键字段名称:https://bbs.huaweicloud.com/forum/thread-193958-1-1.html 如何通过sql实现全表的分析:https://bbs.huaweicloud.com/forum/thread-194033-1-1.html 修改autovacuum参数时报错:https://bbs.huaweicloud.com/forum/thread-193927-1-1.html MRS的Flink连接DWS,运行12小时报错:https://bbs.huaweicloud.com/forum/thread-194438-1-1.html dws执行计划中的actual time代表什么:https://bbs.huaweicloud.com/forum/thread-194574-1-1.html 为何 DWS to_date(xxx,'yyyymmdd')关联比 cast(xxx as date) 关联效率慢:https://bbs.huaweicloud.com/forum/thread-194316-1-1.html 【数仓GaussDB(DWS)】【bytea类型】使用postgresql.jar驱动包解析出错:https://bbs.huaweicloud.com/forum/thread-195190-1-1.html 【华为云DWS】【ODBC】PHP ODBC连接公有云上的DWS数据库怎么操作啊:https://bbs.huaweicloud.com/forum/thread-195440-1-1.html 【GaussDB】【bytea类型】column "bytes_" is of type bytea but expressio:https://bbs.huaweicloud.com/forum/thread-195501-1-1.html GaussDB(DWS)存储过程exception捕捉others异常后,记录日志的语句不会提交:https://bbs.huaweicloud.com/forum/thread-195599-1-1.html ## AI开发平台ModelArts 【CodeLab】开发环境有点老,有计划更新吗:https://bbs.huaweicloud.com/forum/thread-192975-1-1.html 2022华为开发者大赛 · 崇本英才·智汇吴江· 无人车挑战赛 判分失败 scoring job failed:https://bbs.huaweicloud.com/forum/thread-193791-1-1.html 【沈阳昇腾创新中心+openlab训练回归模型警告问题】(NPU使用问题):https://bbs.huaweicloud.com/forum/thread-193768-1-1.html 用yolov5模型训练,上传数据集应该遵循哪种格式,是否需要添加验证集?https://bbs.huaweicloud.com/forum/thread-193706-1-1.html ModelArts支持视频流分析吗? https://bbs.huaweicloud.com/forum/thread-193943-1-1.html modelarts训练作业时,从obs下载文件,下载速率是多少?https://bbs.huaweicloud.com/forum/thread-193705-1-1.html 【Codelab】请问下Codelab里打开的notebook,是否可能SSH接入:https://bbs.huaweicloud.com/forum/thread-194854-1-1.html 【ModelArts】【Notebook】VScode不能用SSH连接ModelArts Notebook:https://bbs.huaweicloud.com/forum/thread-194556-1-1.html ModelArts训练开发故障“临终遗言“:https://bbs.huaweicloud.com/forum/thread-194442-1-1.html 【在线服务】【404】在线服务部署后预测失败是什么原因呀:https://bbs.huaweicloud.com/forum/thread-194910-1-1.html 【数据集】【分割】请教一下这个数据集的annotation怎么看?https://bbs.huaweicloud.com/forum/thread-194873-1-1.html 【ModelArts产品】【模型训练功能】用coco2014数据集训练yolov3-darknet53模型报错:https://bbs.huaweicloud.com/forum/thread-194920-1-1.html 金融情绪分析FinBERT 无法正常跑通(调小batch):https://bbs.huaweicloud.com/forum/thread-195281-1-1.html 【ModelArts产品】【模型训练功能】tacotron2训练报错,缺少unidecode模组:https://bbs.huaweicloud.com/forum/thread-195327-1-1.html notebook的资费是不是涨了:https://bbs.huaweicloud.com/forum/thread-195442-1-1.html ## 华为HiLens & ModelBox 用hilens studio创建技能时,再导入OM文件时,一直在报导入模型失败:https://bbs.huaweicloud.com/forum/thread-194172-1-1.html hilens 技能开发页面导入自己模型,启动技能没反应:https://bbs.huaweicloud.com/forum/thread-193032-1-1.html HiLens如何用HDMI来连接显示屏:https://bbs.huaweicloud.com/forum/thread-193510-1-1.html hilens设备告警看不懂,日志内容怎么看:https://bbs.huaweicloud.com/forum/thread-194133-1-1.html hilens studio与手机摄像头实现视频流显示的错误:https://bbs.huaweicloud.com/forum/thread-194162-1-1.html hilens怎么保存视频(推理后):https://bbs.huaweicloud.com/forum/thread-194037-1-1.html hilens的摄像头如何录制视频,并且保存在自己想要保存 的位置:https://bbs.huaweicloud.com/forum/thread-194434-1-1.html 打不开hilens kit的ip地址:https://bbs.huaweicloud.com/forum/thread-194688-1-1.html ## 混合云FusionInsight hive元数据库连接:https://bbs.huaweicloud.com/forum/thread-192987-1-1.html Flink的准备安全认证问题:https://bbs.huaweicloud.com/forum/thread-193349-1-1.html flink提交任务运行失败:https://bbs.huaweicloud.com/forum/thread-193657-1-1.html 如何查看sceurity 是否配置成功(Flink客户端):https://bbs.huaweicloud.com/forum/thread-193744-1-1.html Flink的JDBCsink,batchintervalMs和BatchSize参数问题:https://bbs.huaweicloud.com/forum/thread-195124-1-1.html spark客户端提交代码报错Unable to obtain password from user 找不到密码:https://bbs.huaweicloud.com/forum/thread-195544-1-1.html ## MapReduce服务 【MRS产品】【hetuengine功能】hetu配置clickhouse数据源与clickhouse查询的结果不一致:https://bbs.huaweicloud.com/forum/thread-192997-1-1.html 【MRS产品】【hetu配置数据源功能】hetu是否能配置hive的内置元数据库数据源:https://bbs.huaweicloud.com/forum/thread-193786-1-1.html 【MRS】【hetu查询】进入hetu命令行不管输入什么都报错:Error running command: java.net.:https://bbs.huaweicloud.com/forum/thread-195417-1-1.html
-
创想无限,2022华为开发者大赛邀你来挑战!作为华为ICT领域的顶级赛事,本次大赛分为云底座和产业两大赛道,包含云应用创新、代码上太空、世界难题、无人车等7大赛事,总奖金额高达500万。从7月开始,华为云将围绕AI、IoT、PaaS、数据库、媒体、容器、数通等领域,陆续举办赛题解读系列直播活动,分享技术干货和实战经验,为参赛团队和选手提供专业技术指导。7月18日,华为开发者大赛赛题解读直播第五场热力继续。本场直播中,华为云EI产品的技术专家将解读赛题相关的关键技术要点,并现场答疑,指导参赛选手快速的上手华为开放技术能力。直播主题华为开发者大赛——如何使用华为云EI产品做创新应用开发直播时间2022年7月18日19:00-20:00直播内容ModelArts一站式AI开发平台使用及介绍AI gallery介绍AI应用框架ModelBox使用及介绍报名方式 扫描二维码 立即预约报名
-
## EI企业智能2022年6月高热贴合集 以下是EI企业智能板块在2022年6月份的高热贴的合集。从合集中基本可以看出,本月HiLens、ModelArts、DWS板块的热度是相对比较高的。 ## 数仓GaussDB(DWS) 哪张系统表记录最后一次vacuum full时间:https://bbs.huaweicloud.com/forum/thread-190851-1-1.html GaussDB 200 6.5.1 配置规划工具 04.xlsm---求模板:https://bbs.huaweicloud.com/forum/thread-192240-1-1.html 【DWS】想把所有存储过程的定义导出来,有什么办法?:https://bbs.huaweicloud.com/forum/thread-192467-1-1.html 如何定时analyse所有库所有表,或者特定库的所有表:https://bbs.huaweicloud.com/forum/thread-192662-1-1.html 安装gaussdb出现Failed to umount cgroup问题:https://bbs.huaweicloud.com/forum/thread-192748-1-1.html ## ModelArts 【modelarts】【codelab】试用的p100 gpu不生效,还是cpu机器:https://bbs.huaweicloud.com/forum/thread-189823-1-1.html python包如何导入:https://bbs.huaweicloud.com/forum/thread-190016-1-1.html 模型发布问题,请专家进来看看(model目录下存在多个模型):https://bbs.huaweicloud.com/forum/thread-59795-1-1.html 预置算法(怎么总结预置算法开发这一流程):https://bbs.huaweicloud.com/forum/thread-190684-1-1.html 如何使用np将文件写入fromfile,存储在OBS系统上:https://bbs.huaweicloud.com/forum/thread-191162-1-1.html 【NPU910产品】【tf1迁移模型】运行提示没有用到NPU:https://bbs.huaweicloud.com/forum/thread-190152-1-1.html Notebook中matplotlib使用中文显示问题:https://bbs.huaweicloud.com/forum/thread-192208-1-1.html 预置算法-华为云AI开发流水线:https://bbs.huaweicloud.com/forum/thread-190684-1-1.html 在modelarts跑bert的下游任务,报错。用的modelzoo上的案例代码,并将2分类修改为17分类。数据是客户自己的。:https://bbs.huaweicloud.com/forum/thread-192877-1-1.html 【Modelarts】【LSTM模型训练】数据集格式转换问题:https://bbs.huaweicloud.com/forum/thread-192876-1-1.html 【Modelarts】【STGCN模型训练】数据集格式转换问题:https://bbs.huaweicloud.com/forum/thread-192846-1-1.html ## HiLens 想要用pytorch 来部署一个技能,有没有可参考的文档,(从0开始部署的)(怎么在Studio转换om模型):https://bbs.huaweicloud.com/forum/thread-190225-1-1.html 【Hilens产品】【语音功能】应用pyttsx3文本转语音调试错误:https://bbs.huaweicloud.com/forum/thread-191381-1-1.html 播放acc音频报错:https://bbs.huaweicloud.com/forum/thread-191377-1-1.html 用Hilens Studio调试下发到Hilens kit的模型跑不起来:https://bbs.huaweicloud.com/forum/thread-192053-1-1.html 用Hilens Studio调试,加载模型失败:https://bbs.huaweicloud.com/forum/thread-192001-1-1.html ## MRS 下载MRS样例代码,maven报错(依赖问题):https://bbs.huaweicloud.com/forum/thread-191674-1-1.html ## FusionInsight 【数据可视化DLV】【数据连接是数据湖探索DLT】利用SQL语句查询时仅能传回50条数据?https://bbs.huaweicloud.com/forum/thread-190342-1-1.html 关于河图引擎:https://bbs.huaweicloud.com/forum/thread-192255-1-1.html ## MapReduce MapReduce 使用hue提交自己的spark jar 包不能执行成功:https://bbs.huaweicloud.com/forum/thread-190496-1-1.html 【MRS产品】如何从开源大数据平台切换MRS大数据平台:https://bbs.huaweicloud.com/forum/thread-192468-1-1.html ## DGC 单表迁移作业报错Timestamp format must be yyyy-mm-dd hh:mm:ss[.fffffffff]:https://bbs.huaweicloud.com/forum/thread-192575-1-1.html ## 云数据迁移 【CDM】【单表迁移】DWS自动建表报错“column name “tid” conflicts with a system:https://bbs.huaweicloud.com/forum/thread-192566-1-1.html 【CDM】抽取HBASE表数据报错”HBASE_CONNECTOR_1104:Failed to open tablble.:https://bbs.huaweicloud.com/forum/thread-192571-1-1.html
-
## EI企业智能2022年5月高热贴合集 以下是EI企业智能板块在2022年5月份的高热贴的合集。从合集中基本可以看出,本月HiLens、ModelArts、DWS板块的热度是相对比较高的。可能是弄到HiLens后,有个硬件设备还是比较有兴趣一些,有兴趣一些就玩的多一些,玩的多一些就问题多一些,问题多一些就发帖多一些了~而且弄到二手的HiLens其实涉及到账号解绑重新绑定的问题,所以如果是新手的话问题就多一些了。 ## 图像识别 【图像识别Image】【调用API】使用token认证鉴权出现API不存在] :https://bbs.huaweicloud.com/forum/thread-187742-1-1.html 【 image_celebrity_recognition产品】【名人识别功能】一不会用,界面不友好 :https://bbs.huaweicloud.com/forum/thread-187682-1-1.html ## 数仓GaussDB(DWS) 【DWS产品】【SQL功能】查询表报错(no data is read from xxx):https://bbs.huaweicloud.com/forum/thread-188110-1-1.html 【DWS】【vacuum功能】行存分区表,对单分区做vacuum full操作是否锁整表:https://bbs.huaweicloud.com/forum/thread-188020-1-1.html 【GaussDB A产品】【XXX功能】创建Function时入参使用的是TYPE类型的参数但显示入参是未知:https://bbs.huaweicloud.com/forum/thread-187834-1-1.html 【高斯产品】【存储功能】表无法操作,提示counld not open relation with OID(集群故障修复后):https://bbs.huaweicloud.com/forum/thread-188569-1-1.html ## ModelArts 【Modelarts产品】【远程开发】用Pycharm Toolkit远程连接notebook:https://bbs.huaweicloud.com/forum/thread-187666-1-1.html ModelArts部署出现ImportError: /lib/x86_64-linux-gnu/libm.so.6:https://bbs.huaweicloud.com/forum/thread-188383-1-1.html (ModelArts的vscode插件)点击按钮配置用户信息没反应:https://bbs.huaweicloud.com/forum/thread-187167-1-1.html notebook运行报错(AI象棋):https://bbs.huaweicloud.com/forum/thread-188832-1-1.html 【训练作业】【YOLOv3_Darknet53算法】如何增加参数支持Balanced Loss?:https://bbs.huaweicloud.com/forum/thread-188703-1-1.html ## HiLens Atlas 200 HiLens Kit 注册失败,提示"The username or password is wrong.":https://bbs.huaweicloud.com/forum/thread-188212-1-1.html HiLens Kit为什么不把其他接口开放出来呢:https://bbs.huaweicloud.com/forum/thread-187769-1-1.html 【hilens产品】如何更新固件:https://bbs.huaweicloud.com/forum/thread-189092-1-1.html hilens 想请问一下技能的开源代码在哪里找:https://bbs.huaweicloud.com/forum/thread-188782-1-1.html 找不到原注册设备的账号,能申请解绑吗?:https://bbs.huaweicloud.com/forum/thread-188539-1-1.html 在哪里查看,检测的图像,并且查看一秒能获取多少帧:https://bbs.huaweicloud.com/forum/thread-189404-1-1.html hilens设备开启之后,信息储存在哪,是否可以指定存储信息:https://bbs.huaweicloud.com/forum/thread-189407-1-1.html pytorch框架能否使用,或者pytorch转caffe/TensorFlow能否使用:https://bbs.huaweicloud.com/forum/thread-189408-1-1.html ## MRS IDEA本地连接用Spark连接HIVE的问题:https://bbs.huaweicloud.com/forum/thread-189094-1-1.html 代码执行安全认证出错:https://bbs.huaweicloud.com/forum/thread-189362-1-1.html 【MRS产品】大数据MRS 对接Streamx安装配置教程:https://bbs.huaweicloud.com/forum/thread-189287-1-1.html ## FusionInsight FusionInsight 做主备HA检测时,备节点能ha替代主,但是主节点一直无法启动oms.sh也无法启动HA:https://bbs.huaweicloud.com/forum/thread-189397-1-1.html
-
获取您的EI红宝书:https://www.huaweicloud.com/ei/ AI测试是对基于AI的应用系统的测试;与任何系统一样,基于AI的系统具有功能性和非功能性需求。AI应用测试的主要流程包括场景分析,特征因子分析,数据构建,评测指标,自动化方案等AI应用测试AI测试任务分层AI应用测试框架关键角色AI开发工程师负责设计、开发实现、数据验收、自测、调优等工作数据工程师负责数据采集、数据清洗、数据整合、数据标注、数据质量检测等工作测试工程师负责测试数据采集、测试场景分析、测试方案、测试用例、测试策略、测试自动化、测试验收和评估等工作测试流程和活动① 结合需求描述,梳理典型应用场景,场景使用主体、特点等,将场景细化② 基于场景分析,分析影响Al模型识别率的特征因子,建立特征因子库。不同的AI场景对特征因子要求和复杂度不一样,比如CV应用场景的特征因子有拍摄因素(曝光、角度等)、环境因素(阴晴雨雪、背景等)、属性因素(人物年龄、肤色等)③ 基于应用场景、特征因子等进行数据集构建,包括不限于:数据类别、不同因子比例、环境因素、特定要求等④ 不同业务场景,关注不同的指标,评价的结果也不同,所以需要根据需求场景和侧重点,确定指标和相关定义。比如:有些业务求全,所以召回率优先;有些业务求准,所以准确率优先;有的业务因类别不均衡,要看单个类别的准确率;还有的业务内存非常敏感,所以对模型大小优先。⑤ 自动化批量测试及评测指标统计https://mp.weixin.qq.com/s?__biz=Mzg5Mjc4NjE1Nw==&mid=2247484542&idx=1&sn=4e6a77a15df21988fe72d41e133e8bdf&chksm=c03980fcf74e09eae416f1a5085ecba06804d9e17210e9a32f2706ebe201fbb8ceab4a6d13e8&token=70826191&lang=zh_CN#rd 云与数据- HCCDA-AI合集:https://mp.weixin.qq.com/mp/appmsgalbum?__biz=Mzg5Mjc4NjE1Nw==&action=getalbum&album_id=2398219468813811715&scene=173&from_msgid=2247483927&from_itemidx=1&count=3&nolastread=1#wechat_redirect**
-
获取您的EI红宝书:https://www.huaweicloud.com/ei/ 华为HiLens为端云协同多模态AI开发应用平台,供简单易用的开发框架、开箱即用的开发环境、丰富的AI技能市场和云上管理平台,接多种端侧计算设备,支持视觉及听觉AI应用开发、AI应用在线部署、海量设备管理等https://mp.weixin.qq.com/s?__biz=Mzg5Mjc4NjE1Nw==&mid=2247484541&idx=1&sn=8356331b4085c76c3a5139407ac59766&chksm=c03980fff74e09e907c12129a5daaa527d20111fa818c74d2acdd0a0e930d4dd8f4d00e0d792&token=1539735248&lang=zh_CN#rd 云与数据- HCCDA-AI合集:https://mp.weixin.qq.com/mp/appmsgalbum?__biz=Mzg5Mjc4NjE1Nw==&action=getalbum&album_id=2398219468813811715&scene=173&from_msgid=2247483927&from_itemidx=1&count=3&nolastread=1#wechat_redirect**
上滑加载中
推荐直播
-
华为云码道Agent集成与鸿蒙实战2026/08/11 周二 19:00-21:00
王一男-华为云码道产品规划专家;李炎-华为云码道产品专家;彭江敏-华为云鸿蒙端云一体化开发专家
本次直播带你解读华为云码道7月份产品新特性、新功能。更有专家演示码道Agent Space × 钉钉机器集成实战,从0到1打通消息通道;码道鸿蒙端云一体化实战,快速搭建员工签到系统。
回顾中 -
华为云开发者AI素养直播课·第五期2026/09/04 周五 16:00-18:00
林华鼎-华为云AI开发者运营负责人;蒋春阳-华为云AI开发者案例开发专家
本期直播内容: AI工具体验营 · 第5-8课连讲。Agent-Team 多智能体协作完成毕业设计实践
回顾中 -
华为云开发者AI素养ClassRoom·第六期2026/09/08 周二 19:00-20:00
樊渊-2026华为软件挑战赛冠军
高手来了:看软挑高手解析二维排样问题—从工业难题到算法突破
回顾中
热门标签