- 随着 AI 服务的广泛应用,调用链路的安全性和稳定性成为开发者关注的重点。本文从实际工程角度,探讨如何通过密钥管理、身份解耦和审计追溯构建可靠的 AI 调用基础设施。 随着 AI 服务的广泛应用,调用链路的安全性和稳定性成为开发者关注的重点。本文从实际工程角度,探讨如何通过密钥管理、身份解耦和审计追溯构建可靠的 AI 调用基础设施。
- 注意:本文中的基准数据反映了 2026 年 5 月的 AgentLogsBench 结果。该基准会定期更新。当一个 Coding Agent 在生产环境中陷入循环时,问题往往不会以清晰的错误码出现。它可能为了修复一个失败的测试反复编辑同一个文件,多次调用相同工具,持续消耗 token,最终仍然返回一个不可用的 patch。此时,平台团队需要在极短时间内判断:这是单条 trace 的异常、某个... 注意:本文中的基准数据反映了 2026 年 5 月的 AgentLogsBench 结果。该基准会定期更新。当一个 Coding Agent 在生产环境中陷入循环时,问题往往不会以清晰的错误码出现。它可能为了修复一个失败的测试反复编辑同一个文件,多次调用相同工具,持续消耗 token,最终仍然返回一个不可用的 patch。此时,平台团队需要在极短时间内判断:这是单条 trace 的异常、某个...
- 在2026年的今天,社交媒体早已不是“要不要做”的问题,而是“怎么做才有效”的问题。对于中小企业来说,人力有限、预算紧张,却要同时运营抖音、小红书、知乎、头条、百家号等多个平台——一个人要兼顾文案、设计、剪辑、发布,还要盯评论区,恨不得有三头六臂。更让人焦虑的是,客户的消费决策方式已经彻底变了。以前客户打开百度搜一搜,你的官网排在前面就能接到电话。现在呢?客户在抖音、小红书里刷内容,在知乎里... 在2026年的今天,社交媒体早已不是“要不要做”的问题,而是“怎么做才有效”的问题。对于中小企业来说,人力有限、预算紧张,却要同时运营抖音、小红书、知乎、头条、百家号等多个平台——一个人要兼顾文案、设计、剪辑、发布,还要盯评论区,恨不得有三头六臂。更让人焦虑的是,客户的消费决策方式已经彻底变了。以前客户打开百度搜一搜,你的官网排在前面就能接到电话。现在呢?客户在抖音、小红书里刷内容,在知乎里...
- 域分类实验 — 最终评测报告日期: 2026年7月7日实验者: infinite评测执行: infinite(Elo盲评+五维评分)、Coze/千问(MT-Bench)、infinite(逐条通读) 一、实验条件 1.1 模型与运行环境项目配置生成模型DeepSeek V4 Pro (deepseek-v4-pro[1m])APIAnthropic 兼容接口,stream 模式max_tok... 域分类实验 — 最终评测报告日期: 2026年7月7日实验者: infinite评测执行: infinite(Elo盲评+五维评分)、Coze/千问(MT-Bench)、infinite(逐条通读) 一、实验条件 1.1 模型与运行环境项目配置生成模型DeepSeek V4 Pro (deepseek-v4-pro[1m])APIAnthropic 兼容接口,stream 模式max_tok...
- 阿里7天全集团切换模型,暴露了业务代码与供应商深度绑定的架构风险:Prompt适配、私有参数、监控对接均需改代码。解法是抽象“AI路由层”,用逻辑模型(如code_generation)替代物理模型名,实现配置化切换——留一层,换供应商只需改映射,而非改代码。 阿里7天全集团切换模型,暴露了业务代码与供应商深度绑定的架构风险:Prompt适配、私有参数、监控对接均需改代码。解法是抽象“AI路由层”,用逻辑模型(如code_generation)替代物理模型名,实现配置化切换——留一层,换供应商只需改映射,而非改代码。
- 以 Transformer 自注意力机制为类比,探讨多模型、多团队成员场景下的 API 凭证治理、调用策略执行和成本审计方案,以及基于虚拟 Key 的工程实践。 以 Transformer 自注意力机制为类比,探讨多模型、多团队成员场景下的 API 凭证治理、调用策略执行和成本审计方案,以及基于虚拟 Key 的工程实践。
- 导读:快手 AB 指标生产场景从 Spark 切换到 Doris 提速 145 倍、资源消耗下降 72%,并刷新了 Doris 单机群最大规模:2000 节点、10 万核。本文介绍快手数据平台团队为什么选择 Apache Doris 构建 AB 实验平台,针对 AB 指标生产场景进行了哪些落地过程中的存储、计算、调度、稳定性等方面优化。快手的干货分享,对需要构建 AB 实验平台的团队有很大的... 导读:快手 AB 指标生产场景从 Spark 切换到 Doris 提速 145 倍、资源消耗下降 72%,并刷新了 Doris 单机群最大规模:2000 节点、10 万核。本文介绍快手数据平台团队为什么选择 Apache Doris 构建 AB 实验平台,针对 AB 指标生产场景进行了哪些落地过程中的存储、计算、调度、稳定性等方面优化。快手的干货分享,对需要构建 AB 实验平台的团队有很大的...
- 前面的文章在构建RAG并检索时,既使用了国外大模型,也使用了国内大模型;既运用了内存向量检索库FAISS,也运用了磁盘向量数据库Chroma。但知识库的原始来源却是knowledge数组,这与现实场合有所出入,因为实际资料都保存在TXT、PDF、WORD等格式的文档中,甚至来自互联网上的HTML网页,于是RAG的前置条件就成了如何从这些文档中提取文本信息。一、读取TXT文件中的文本TXT文件... 前面的文章在构建RAG并检索时,既使用了国外大模型,也使用了国内大模型;既运用了内存向量检索库FAISS,也运用了磁盘向量数据库Chroma。但知识库的原始来源却是knowledge数组,这与现实场合有所出入,因为实际资料都保存在TXT、PDF、WORD等格式的文档中,甚至来自互联网上的HTML网页,于是RAG的前置条件就成了如何从这些文档中提取文本信息。一、读取TXT文件中的文本TXT文件...
- 一次客户端逆向发现揭示了一个被忽视的安全问题——本地程序可以在 API 通信中嵌入用户身份标记。本文探讨如何通过架构设计而非对抗式修改来保护开发者隐私。 一次客户端逆向发现揭示了一个被忽视的安全问题——本地程序可以在 API 通信中嵌入用户身份标记。本文探讨如何通过架构设计而非对抗式修改来保护开发者隐私。
- 本文介绍了一个基于ChatGLM3-6B大模型的本地化部署方案,采用FastAPI后端和Web前端实现完整对话系统。项目特点包括:1)适配RTX4090显卡,支持FP16半精度推理,显存占用优化;2)提供两种推理模式(一次性返回和SSE流式输出);3)内置完善监控系统,实时采集显存、Token生成速度等指标;4)兼容OpenAI API标准接口;5)包含可视化前端界面。系统采用四层架构设计,包含前 本文介绍了一个基于ChatGLM3-6B大模型的本地化部署方案,采用FastAPI后端和Web前端实现完整对话系统。项目特点包括:1)适配RTX4090显卡,支持FP16半精度推理,显存占用优化;2)提供两种推理模式(一次性返回和SSE流式输出);3)内置完善监控系统,实时采集显存、Token生成速度等指标;4)兼容OpenAI API标准接口;5)包含可视化前端界面。系统采用四层架构设计,包含前
- 本文系统解析了开源大模型命名规则中的后缀含义,帮助用户根据需求精准选择模型。文章指出模型后缀遵循"基座名称-参数标识-优化类型-功能标签-量化格式"的标准化结构,包含五大类关键信息:1)参数量标识(B/b)区分模型规模;2)微调类型标识(如it/thinking/turbo)决定适用场景;3)量化格式(GGUF/FP16等)影响硬件兼容性;4)专项功能后缀(ASR/Image等 本文系统解析了开源大模型命名规则中的后缀含义,帮助用户根据需求精准选择模型。文章指出模型后缀遵循"基座名称-参数标识-优化类型-功能标签-量化格式"的标准化结构,包含五大类关键信息:1)参数量标识(B/b)区分模型规模;2)微调类型标识(如it/thinking/turbo)决定适用场景;3)量化格式(GGUF/FP16等)影响硬件兼容性;4)专项功能后缀(ASR/Image等
- LLM推理精度:基于学科域语义路由的推理框架构造方法 摘要在160次API调用实验中,通过将教育部14门类学科分类体系映射为LLM推理的认知路由层——在推理前自动识别输入文本涉及的学科域、提取该域的分析框架、结构化注入推理提示词——在不修改模型参数、不增加调用次数的情况下,将单次推理的物质还原比例从36.6%(泛化"专家"角色扮演)提升至61.4%,提升幅度达67.5%。跨轮次标准差0.1... LLM推理精度:基于学科域语义路由的推理框架构造方法 摘要在160次API调用实验中,通过将教育部14门类学科分类体系映射为LLM推理的认知路由层——在推理前自动识别输入文本涉及的学科域、提取该域的分析框架、结构化注入推理提示词——在不修改模型参数、不增加调用次数的情况下,将单次推理的物质还原比例从36.6%(泛化"专家"角色扮演)提升至61.4%,提升幅度达67.5%。跨轮次标准差0.1...
- 如何避开80% AI项目失败率? 如何避开80% AI项目失败率?
- 随着 AI 应用和实时分析场景深入,进入数据平台的不再只是结构化业务表。日志、JSON、文本内容、行为事件、模型推理结果等半结构化和非结构化数据,正在成为实时分析的常见对象。与此同时,分析链路中要完成的工作也在变化:它不再只是 COUNT、SUM、GROUP BY,还包括规则判断、字段解析、特征加工、标签抽取、模型打分等更复杂的业务逻辑。这些逻辑往往更适合用 Python 实现。但如果把数据... 随着 AI 应用和实时分析场景深入,进入数据平台的不再只是结构化业务表。日志、JSON、文本内容、行为事件、模型推理结果等半结构化和非结构化数据,正在成为实时分析的常见对象。与此同时,分析链路中要完成的工作也在变化:它不再只是 COUNT、SUM、GROUP BY,还包括规则判断、字段解析、特征加工、标签抽取、模型打分等更复杂的业务逻辑。这些逻辑往往更适合用 Python 实现。但如果把数据...
- 当AI客服已成为企业标配,如何从“能回答问题”进化到“能转化商机”?2026年,企业客户服务领域正在经历一场深刻变革。根据Salesforce对全球3075名服务行业专业人士的调查,部署AI智能体的企业比例已从2025年的39%大幅跃升至66%。更值得关注的是,七成企业在部署AI客服智能体后的60天内就实现了投资回报。与此同时,国家市场监督管理总局发布了《顾客联络服务 人工与智能客户服务协同... 当AI客服已成为企业标配,如何从“能回答问题”进化到“能转化商机”?2026年,企业客户服务领域正在经历一场深刻变革。根据Salesforce对全球3075名服务行业专业人士的调查,部署AI智能体的企业比例已从2025年的39%大幅跃升至66%。更值得关注的是,七成企业在部署AI客服智能体后的60天内就实现了投资回报。与此同时,国家市场监督管理总局发布了《顾客联络服务 人工与智能客户服务协同...
上滑加载中
推荐直播
-
华为云码道Skill实战与极速交付,智能开发全链路实战2026/07/22 周三 19:00-21:00
王一男-华为云码道产品规划专家;李炎-华为云码道产品专家;姜浩-华为云HCDG核心组成员
直播深度解读华为云码道6月产品新特性,从Skill市场安装专家技能,带你零距离体验从需求,开发,审查,重构全链路闭环的开发过程。从零构建并交付一个完整项目,让您体验从代码提交到服务上线的“极速”之旅。
回顾中 -
聚开发者之力,创具身新未来2026/07/23 周四 15:00-17:00
张豪杰/程文/王军/刘新春/黄钦开 /张晓天
本次华为云具身智能开发平台CloudRobo培训面向具身智能开发者,带您全流程体验机器人本体R2C小时级接入、环境重建与轨迹生成仿真数据生产、PB级数据管理、数据评测、模型训推、强化学习和Benchmark一键评测等功能,并体验业界主流具身模型应用。
回顾中
热门标签