- 场景描述:https://console.huaweicloud.com/ocr/?locale=zh-cn®ion=cn-north-4#/ocr/sandbox[图片] 建议方案: 场景描述:https://console.huaweicloud.com/ocr/?locale=zh-cn®ion=cn-north-4#/ocr/sandbox[图片] 建议方案:
- 场景描述:正好想用智智能文档解析功能,又刚好想试试CodeArts,这不就开始用了嘛。但是我都已经手动把SDK导进项目了,也明确告知要调用华为云智能文档解析的API。GLM4.7不知道去用SDK,还在写HTTP。。。然后我打断了AI的工作,明确告知我已经有SDK了,请用SDK。然后AI吭哧吭哧把代码跑完了,然后我一看,参数都是错的。啊这。。。 建议方案:我就一点要求,咱能把自己的接口支持度调的顺滑一点吗?当然如果GLM5已经完善了这一块,也可以反馈给我。PS:关联产品/功能没找到智能文档解析,就选了文字识别通用类。 场景描述:正好想用智智能文档解析功能,又刚好想试试CodeArts,这不就开始用了嘛。但是我都已经手动把SDK导进项目了,也明确告知要调用华为云智能文档解析的API。GLM4.7不知道去用SDK,还在写HTTP。。。然后我打断了AI的工作,明确告知我已经有SDK了,请用SDK。然后AI吭哧吭哧把代码跑完了,然后我一看,参数都是错的。啊这。。。 建议方案:我就一点要求,咱能把自己的接口支持度调的顺滑一点吗?当然如果GLM5已经完善了这一块,也可以反馈给我。PS:关联产品/功能没找到智能文档解析,就选了文字识别通用类。
- 场景描述: Cherry Studio是目前一个易用的AI客户端,在该软件的模型服务中,有很多模型平台的支持,包含深度求索、阿里云百炼等。 建议方案: 建议与他们合作在Cherry Studio的模型服务中,增加“华为云”的支持,包含API的快速配置,OCR文档处理的服务器支持等。注:很多人去不到开发产品的高度,建议也要重视这部分人群。 场景描述: Cherry Studio是目前一个易用的AI客户端,在该软件的模型服务中,有很多模型平台的支持,包含深度求索、阿里云百炼等。 建议方案: 建议与他们合作在Cherry Studio的模型服务中,增加“华为云”的支持,包含API的快速配置,OCR文档处理的服务器支持等。注:很多人去不到开发产品的高度,建议也要重视这部分人群。
- 场景描述:通用表格产品调用的API响应结果中,没有正确反映出“return_rectification_matrix”请求字段的差异,并且渲染响应结果中的表格单元格坐标,发现整体偏移了! 建议方案:查证是否返回的单元格坐标结果是经过了透视变换的,应遵从原始输入图像的坐标系,或者返回“rectification_matrix”以便于开发者进行后处理! 场景描述:通用表格产品调用的API响应结果中,没有正确反映出“return_rectification_matrix”请求字段的差异,并且渲染响应结果中的表格单元格坐标,发现整体偏移了! 建议方案:查证是否返回的单元格坐标结果是经过了透视变换的,应遵从原始输入图像的坐标系,或者返回“rectification_matrix”以便于开发者进行后处理!
- 场景描述: 文字识别模块中的服务监控,导出的数据有空格 [图片] [图片] 建议方案: 去除数据中多余的空格 场景描述: 文字识别模块中的服务监控,导出的数据有空格 [图片] [图片] 建议方案: 去除数据中多余的空格
- 场景描述:OCR demo的延迟还是有点厉害的,我鼠标移动到右侧某个框,左图会加深显示,但是反应慢的时候会同时显示两个 建议方案:鼠标移动到下一个后,就取消第一个框的加深显示。然后去找新的框,这样就不会同时加深两个了 [图片] 场景描述:OCR demo的延迟还是有点厉害的,我鼠标移动到右侧某个框,左图会加深显示,但是反应慢的时候会同时显示两个 建议方案:鼠标移动到下一个后,就取消第一个框的加深显示。然后去找新的框,这样就不会同时加深两个了 [图片]
- 场景描述:OCR表格识别有两张表,结果导出excel只有一张了 [图片] [图片] 建议方案: 场景描述:OCR表格识别有两张表,结果导出excel只有一张了 [图片] [图片] 建议方案:
-
【用户体验】OCR智能文档解析,图片内容识别有误 预审不通过场景描述: 非常明显的数字81,最后给出的结果是18 建议方案: 改进识别准确度 场景描述: 非常明显的数字81,最后给出的结果是18 建议方案: 改进识别准确度
- 场景描述: [图片] OCR里面通用表格识别图片文字,换行文本上一行末尾和下一行开头中间连在一起了,好提取数据,能不能加个开的功能 建议方案: 场景描述: [图片] OCR里面通用表格识别图片文字,换行文本上一行末尾和下一行开头中间连在一起了,好提取数据,能不能加个开的功能 建议方案:
- 场景描述: OCR项目很多,购买多个接口,每个接口单独充值配额麻烦,充值少了费用太高(相对百度、阿里、腾讯等),充值多了又用不完 建议方案: 像百度一样,推出一个“共享资源包”的功能,可以选择共享范围(哪些接口),这样可以一次性购买更多的配额,让各各接口共享这个配额,不仅方便管理,也方便对账计费;这样相对来说,单次费用降低了,使用量会增加,华为本身并没有利益损失,是一个双赢的方式,请核准! [图片] 场景描述: OCR项目很多,购买多个接口,每个接口单独充值配额麻烦,充值少了费用太高(相对百度、阿里、腾讯等),充值多了又用不完 建议方案: 像百度一样,推出一个“共享资源包”的功能,可以选择共享范围(哪些接口),这样可以一次性购买更多的配额,让各各接口共享这个配额,不仅方便管理,也方便对账计费;这样相对来说,单次费用降低了,使用量会增加,华为本身并没有利益损失,是一个双赢的方式,请核准! [图片]
- [图片] [图片]
- 文字识别 建议OCR服务支持二维码识别,场景:使用ocr识别二维码中的内容 https://console.huaweicloud.com/ocr/?region=cn-north-4&locale=zh-cn#/ 文字识别 建议OCR服务支持二维码识别,场景:使用ocr识别二维码中的内容 https://console.huaweicloud.com/ocr/?region=cn-north-4&locale=zh-cn#/
-
【功能建议】试用OCR提示接口异常 预审不通过场景描述: [图片] 建议方案: 场景描述: [图片] 建议方案:
- 场景描述:OCR识别,这个人的字写的还挺清楚的,但是识别不准确 [图片] [图片] 建议方案: 场景描述:OCR识别,这个人的字写的还挺清楚的,但是识别不准确 [图片] [图片] 建议方案:
- 场景描述:识别结果的JSON结果,点击Ctrl+A会选中整个页面的文字 [图片] 建议方案:合理的操作,应该是只选中JSON结果这个文本框里的文字(因为我要全选复制到剪贴板) 场景描述:识别结果的JSON结果,点击Ctrl+A会选中整个页面的文字 [图片] 建议方案:合理的操作,应该是只选中JSON结果这个文本框里的文字(因为我要全选复制到剪贴板)
上滑加载中
推荐直播
-
用码道,让你的AI作品三步上朋友圈2026/08/04 周二 19:00-20:00
林华鼎-华为云AI开发者运营负责人
从入门 · 到做AI应用 · 到企业级开发。不教编程,只教用AI · 零代码、有产出、能带走、可炫耀 · 每课人人动手实操
回顾中 -
华为云码道Agent集成与鸿蒙实战2026/08/11 周二 19:00-21:00
王一男-华为云码道产品规划专家;李炎-华为云码道产品专家;彭江敏-华为云鸿蒙端云一体化开发专家
本次直播带你解读华为云码道7月份产品新特性、新功能。更有专家演示码道Agent Space × 钉钉机器集成实战,从0到1打通消息通道;码道鸿蒙端云一体化实战,快速搭建员工签到系统。
回顾中
热门标签