- 本文揭秘大模型性能测试核心差异:告别传统QPS/RT,聚焦TTFT(首字延迟)、TPOT(逐字间隔)等流式指标。通过真实大促事故(首字延迟从0.8秒飙至15秒),剖析容量规划缺失、KV cache打满、无降级等痛点,并给出阶梯压测、拐点识别、混长文本等实战方法,助你应对AI面试高频题。 本文揭秘大模型性能测试核心差异:告别传统QPS/RT,聚焦TTFT(首字延迟)、TPOT(逐字间隔)等流式指标。通过真实大促事故(首字延迟从0.8秒飙至15秒),剖析容量规划缺失、KV cache打满、无降级等痛点,并给出阶梯压测、拐点识别、混长文本等实战方法,助你应对AI面试高频题。
- AI安全测试聚焦“模型服从性”:不攻代码,而用自然语言诱导模型叛变。本文剖析两次真实提示词注入事故,详解红队测试四步法——攻击库建设、边界测试、输出检测与持续回归,强调分层防御与工程化落地。 AI安全测试聚焦“模型服从性”:不攻代码,而用自然语言诱导模型叛变。本文剖析两次真实提示词注入事故,详解红队测试四步法——攻击库建设、边界测试、输出检测与持续回归,强调分层防御与工程化落地。
- 为什么大家从使用MCP转向使用CLI?两种方案到底适合什么场景?普通开发者该怎么选? 为什么大家从使用MCP转向使用CLI?两种方案到底适合什么场景?普通开发者该怎么选?
- AI 测试开发面试高频题:“流式输出接口怎么测?和普通 HTTP 有什么区别?”普通接口测"一次响应",流式接口测"一条事件流"——首字快不快、中间卡不卡、结尾完不完整、断了怎么办。这篇用一次"机器人说半句话"的客诉,把 SSE 的测试点讲全。 一、真实客诉:你们机器人怎么说话说一半?某保险公司的智能顾问用 SSE 流式输出。上线后陆续有用户投诉:"你们机器人说话说一半,是不是故意逗我?“截... AI 测试开发面试高频题:“流式输出接口怎么测?和普通 HTTP 有什么区别?”普通接口测"一次响应",流式接口测"一条事件流"——首字快不快、中间卡不卡、结尾完不完整、断了怎么办。这篇用一次"机器人说半句话"的客诉,把 SSE 的测试点讲全。 一、真实客诉:你们机器人怎么说话说一半?某保险公司的智能顾问用 SSE 流式输出。上线后陆续有用户投诉:"你们机器人说话说一半,是不是故意逗我?“截...
- AI测试开发高频题:测Agent≠测接口,核心是验证“决策链是否失控”。本文以深夜烧万元的真实事故切入,详解如何通过轨迹记录、循环检测与三重熔断(步数/Token/时间)保障Agent可靠性,并将“不失控”写入自动化测试用例。 AI测试开发高频题:测Agent≠测接口,核心是验证“决策链是否失控”。本文以深夜烧万元的真实事故切入,详解如何通过轨迹记录、循环检测与三重熔断(步数/Token/时间)保障Agent可靠性,并将“不失控”写入自动化测试用例。
- 本文系统阐述了生产级实时语音系统的技术架构与优化方案。传统语音系统依赖信号算法和小模型,存在抗干扰差、泛化性弱、延迟高等痛点。大模型技术重构了语音交互逻辑,通过VAD语音检测、唤醒词识别、流式转录三大核心模块的协同优化,实现了精度、实时性和稳定性的全面提升。文章详细分析了各模块的技术原理、传统方案缺陷及大模型优化方法,并提供了基于SileroVAD、Whisper等开源模型的实践代码示例。大模型赋 本文系统阐述了生产级实时语音系统的技术架构与优化方案。传统语音系统依赖信号算法和小模型,存在抗干扰差、泛化性弱、延迟高等痛点。大模型技术重构了语音交互逻辑,通过VAD语音检测、唤醒词识别、流式转录三大核心模块的协同优化,实现了精度、实时性和稳定性的全面提升。文章详细分析了各模块的技术原理、传统方案缺陷及大模型优化方法,并提供了基于SileroVAD、Whisper等开源模型的实践代码示例。大模型赋
- 本文系统阐述了大模型工程化落地的核心方法论——Harness(驾驭工程)与Skills(技能体系)协同框架。针对大模型应用落地难、输出不稳定等问题,提出Harness工程作为管控体系,覆盖权限、参数、频次、结果、重试、状态六大维度,实现AI任务的可控执行;Skills作为标准化业务能力单元,通过单一职责、场景通用等原则实现能力封装。二者协同形成"能力执行+规范管控"的闭环,配套 本文系统阐述了大模型工程化落地的核心方法论——Harness(驾驭工程)与Skills(技能体系)协同框架。针对大模型应用落地难、输出不稳定等问题,提出Harness工程作为管控体系,覆盖权限、参数、频次、结果、重试、状态六大维度,实现AI任务的可控执行;Skills作为标准化业务能力单元,通过单一职责、场景通用等原则实现能力封装。二者协同形成"能力执行+规范管控"的闭环,配套
- 摘要: Prompt工程是高效使用大模型的核心技能,通过精准指令设计最大化AI输出质量。其核心原则包括:精准明确(补充场景、人群、格式等6大要素)、完整上下文(背景+约束+素材+诉求)、结构化逻辑(分层拆解任务)。关键技巧涵盖:角色设定(专业身份锁定)、任务拆解(复杂问题分步执行)、输出约束(格式/风格/篇幅控制)。实际应用中需遵循标准化流程:需求拆解→信息补齐→结构化指令→迭代优化。示例代码展示 摘要: Prompt工程是高效使用大模型的核心技能,通过精准指令设计最大化AI输出质量。其核心原则包括:精准明确(补充场景、人群、格式等6大要素)、完整上下文(背景+约束+素材+诉求)、结构化逻辑(分层拆解任务)。关键技巧涵盖:角色设定(专业身份锁定)、任务拆解(复杂问题分步执行)、输出约束(格式/风格/篇幅控制)。实际应用中需遵循标准化流程:需求拆解→信息补齐→结构化指令→迭代优化。示例代码展示
- 账号级凭证的"全有或全无"困境,以及策略级凭证(虚拟 Key)如何通过身份与使用权解耦,解决多模型场景下的配额、隔离与审计问题。 账号级凭证的"全有或全无"困境,以及策略级凭证(虚拟 Key)如何通过身份与使用权解耦,解决多模型场景下的配额、隔离与审计问题。
- EGO数采视频采集4Mp双目摄像头方案海思3516CV610双目+IMU模组,从硬件层面用同一时钟源触发相机曝光 与IMU采样,从源头保证两组数据的时间基准完全一致。 EGO数采视频采集4Mp双目摄像头方案海思3516CV610双目+IMU模组,从硬件层面用同一时钟源触发相机曝光 与IMU采样,从源头保证两组数据的时间基准完全一致。
- 信通院近期推出 AI 网关可信云能力评估。本文聚焦安全防护与智能体协议两个板块,分析 AI 流量带来的新型安全风险分层,以及网关在检测范式上需要做出的改变。 信通院近期推出 AI 网关可信云能力评估。本文聚焦安全防护与智能体协议两个板块,分析 AI 流量带来的新型安全风险分层,以及网关在检测范式上需要做出的改变。
- 本文系统介绍了大模型多Agent协作系统的核心原理与实践方法。主要内容包括:1)多Agent系统的本质是通过分工协作解决单一大模型处理复杂任务时的局限性,具备角色专属化、行为自主化和交互协同化三大特征;2)详细解析了中心化编排、分层层级和分布式协同三种主流架构的优缺点及适用场景;3)深入讲解了任务拆解、智能分配、时序管控和异常处理等调度核心逻辑,并提供了四种可落地的调度策略;4)给出了从零搭建多A 本文系统介绍了大模型多Agent协作系统的核心原理与实践方法。主要内容包括:1)多Agent系统的本质是通过分工协作解决单一大模型处理复杂任务时的局限性,具备角色专属化、行为自主化和交互协同化三大特征;2)详细解析了中心化编排、分层层级和分布式协同三种主流架构的优缺点及适用场景;3)深入讲解了任务拆解、智能分配、时序管控和异常处理等调度核心逻辑,并提供了四种可落地的调度策略;4)给出了从零搭建多A
- 本文针对大模型选型难题,系统分析了主流模型的能力边界、成本结构和应用场景。文章将大模型分为闭源商用(如GPT-4o、Claude3.5)和开源可部署(如Llama3、Qwen)两大阵营,指出闭源模型开箱即用但存在数据合规风险,开源模型数据可控但需技术投入。通过对比各模型在RAG知识库和Agent场景的表现,提出选型应基于业务需求、调用规模和团队能力:文档处理优选Claude3.5,多模态任务选择G 本文针对大模型选型难题,系统分析了主流模型的能力边界、成本结构和应用场景。文章将大模型分为闭源商用(如GPT-4o、Claude3.5)和开源可部署(如Llama3、Qwen)两大阵营,指出闭源模型开箱即用但存在数据合规风险,开源模型数据可控但需技术投入。通过对比各模型在RAG知识库和Agent场景的表现,提出选型应基于业务需求、调用规模和团队能力:文档处理优选Claude3.5,多模态任务选择G
- 同一个 Agent,隔几天换个上下文,就不记得你之前交代过的偏好;写代码时,刚修过的 Bug 换个新 Session 又踩一遍。业界虽然有记忆张量、Mem0 等许多方案,但 “各家各自跑,标准不统一” 。近期,由国内外二十多所高校与研究机构联合发起的 Agent Memory Leaderboard (AML) 正式发布,并在 7 月 29 日启动了首届 Agent 记忆挑战赛。这不只是一... 同一个 Agent,隔几天换个上下文,就不记得你之前交代过的偏好;写代码时,刚修过的 Bug 换个新 Session 又踩一遍。业界虽然有记忆张量、Mem0 等许多方案,但 “各家各自跑,标准不统一” 。近期,由国内外二十多所高校与研究机构联合发起的 Agent Memory Leaderboard (AML) 正式发布,并在 7 月 29 日启动了首届 Agent 记忆挑战赛。这不只是一...
- 如何测试一个会自主决策的软件系统 如何测试一个会自主决策的软件系统
上滑加载中
推荐直播
-
华为云码道Agent集成与鸿蒙实战2026/08/11 周二 19:00-21:00
王一男-华为云码道产品规划专家;李炎-华为云码道产品专家;彭江敏-华为云鸿蒙端云一体化开发专家
本次直播带你解读华为云码道7月份产品新特性、新功能。更有专家演示码道Agent Space × 钉钉机器集成实战,从0到1打通消息通道;码道鸿蒙端云一体化实战,快速搭建员工签到系统。
回顾中 -
华为云开发者AI素养直播课·第五期2026/09/04 周五 16:00-18:00
林华鼎-华为云AI开发者运营负责人;蒋春阳-华为云AI开发者案例开发专家
本期直播内容: AI工具体验营 · 第5-8课连讲。Agent-Team 多智能体协作完成毕业设计实践
回顾中
热门标签