-
1.console页面查看是否创建对应的DWS集群的ELB: 1).点击服务列表->网络->弹性负载均衡,查看已有的ELB清单 2).点击名称进入查看后端云服务器组,确定是否绑定DWS集群的cn ip,并在线2.若在线,通过ELB测试可以连接上DWS集群:gsql -h {ELB ip} -d xxx -p {port} -U dbadmin -W {password} -c "show pgxc_node_name" 多次执行分别返回cn_5001 或者cn_5002 或者 cn_5003等表示能均衡分到每个CN节点;
-
升级ecf软件包分发失败问题背景:dws已经升级;ecf没有升级,适用单独创建升级工程升级ecf组件场景问题详情:软件包分发失败ECF服务节点部署MOICagent失败File“/opt’cloud/HUAWE!_CLOUD_Stack_Update/src/FusionCloudUpdate/plugins/project_498/ECF_hcsu_plugin/upgrade/ectiscripts/Sub_Job_Deploy_MOICAgent py”, line 61, in execute self.get_dmk_info() File“optcloud/HUAWEI_CLOUD_Stack_Update'src/FusionCloudUpdatelplugins/project_498/ECF_nesu_plugin/upgrade/ect/scripts/Sub_Job_Deploy_MOICAgent py”. line 89, in get_dmk_info raise Exception("Failed to get mk information for apigw.") Exception: Failed to get dmk information for apigw.问题根因:升级参数检验里面没有关于API_Gateway_apigw_password的参数导致apig账号登录dmk这一步失败;正常升级是dws+ecf一起升级的;dws有这个参数的接口;但是ecf自身没有这个接口;单独升级ecf获取不到此参数导致此工步失败解决方法:联系华为技术人员修改ECF_hcsu_plugin/upgrade/ecf/scripts/Sub_Job_Istall_Moicagent.py中的dmk_user_name 和dmk_pwd值为固定值
-
工具功能在DWS数据节点配置OS core后,检查配置core是否生效。注意事项1.该工具只能检查单节点配置是否生效。2.执行用户 root/omm/Ruby均可。使用方法1.将检查工具check.sh上传至待检查节点,附件为check.txt改为check.sh,执行dos2unix check.sh。2.执行sh check.sh -s unlimited检查该节点gaussdb进程可core大小是否为unlimited配置生效回显 ulimit -c is same as checksize ${size}.Configuration takes effect配置未生效两种回显 1.检查ulimit -c 不匹配ulimit -c is different from checksize, ulimit is ${ulimit_size} checksize is ${size}.2.检查/proc/${pid}/limits不匹配Configuration is not effective. Please see the checkresult.log.未生效请参考配置core工具操作,重新配置后再检查。配置OS core工具案例 https://bbs.huaweicloud.com/forum/thread-192730-1-1.html
-
一、版本:dws813二、问题现象:备实例一个磁盘使用率达到84%,为xlog堆积导致三、定位过程1.进入该实例路径下 pg_controldata ./ 最近checkpoint时间点为去年11月2.dn日志报错:invalid pages3.查出备实例的进程号,gcore 进程号4.使用gdb解gcore5.使用gdb脚本快速搜索和定位出问题的表和索引,脚本见附件6.pg_hash_entry invalid_page_tab xl_invalid_page 查找无效hash表地址,假如为address17.p *(xl_invalid_page *) adress1 打印出库id、表relfielnode等信息8.select * from pg_database where oid=''库id;找到库名,并切换到该库9.select * from pg_class where relfilenode='relfilenode';找到relname10.对找到的表重建索引
-
问题现象1.用户查询自己的视图,显示对表无权限 2.管理员查询视图显示对表无权限问题原因视图定义所属schema所有者,没有权限查询视图定义涉及到的表。排查过程创建测试用户1 postgres=# create user user1 with password 'password@123'; CREATE USER 创建测试用户2 postgres=# create user user2 with password 'password@123'; CREATE USER 用户1创建表 create table user1.t1(id int,name text); 赋予用户2访问的权限 grant usage on schema user1 to user2; grant select on table user1.t1 to use2; 用户2创建视图 create view v1 as select * from user1.t1; 此时user2查询视图是正常的 select * from v1; 当user1重新创建t1表后或者撤销user2对表的权限, 使用管理员查user2的视图会报错 postgres=# select * from user2.v1; ERROR: SELECT permission denied to user "user2" for relation "user1.t1"解决方法重新把表的查询权限给用户user2 grant select on table user1.t1 to user2;
-
问题背景1.业务账号被锁无法登陆(直连CN) 2.业务账号被锁后出现未解锁也可以登录(通过负载均衡连接CN)问题原因1.业务密码错误导致账号被锁 2.DWS高并发模式下提供多个CN,每个节点都具备帐户锁定机制,但各个节点的帐户锁定信息并不共享,每个节点帐户锁定是独立裁定的,即业务通过负载均衡连接的时候转发到未锁定用户的CN可以登录,转发到锁定用户的CN就会报用户被锁。排查过程查看审计日志,看失败的是不是固定在部分CN,如果是就是部分CN被锁,其他CN可以正常登录 select begintime,endtime,result,node_name,username,client_conninfo,detail_info from pgxc_query_audit('2023-02-01','2023-02-03') where audit_type ='user_login' and username='被锁用户名' order by result;解决方法1.进行用户解锁,解锁是全局性的alter user username account unlock; 2.修改密码错误客户端密码,防止再次被锁。
-
此贴持续更新DWS 线下ESL版本升级路径:若当前版本为C80SPC3xx/5xx/7xx/8xx:C80-->8.0.0.2-->8.1.1.6-->8.1.3.6若当前版本为C80SPC300以前的版本,须升级至C80SPC300后再升级:C80-->C80SPC300-->8.0.0.2-->8.1.1.6-->8.1.3.6若当前版本为6.5.1.x:6.5.1-->8.0.0.2-->8.1.1.6-->8.1.3.6若当前版本为8.0.0.x:8.0.0-->8.1.1.6-->8.1.3.6若当前版本为8.1.0:8.1.0-->8.1.1.6-->8.1.3.68.0.0版本最新通用补丁为8.0.0.15补丁集群版本查询:/opt/huawei/Bigdata/om-server/om/sbin/pack/queryPack.sh (omm用户主管理节点执行)在线升级特性:源版本不低于811且目标版本不低于813版本,可在线升级集群升级与OS无关(能安装就能升级):只要集群可以正常安装使用,那么不管此OS后续是否在高版本的兼容列表,此集群都可以正常进行版本升级在线扩容:仅指数据重分布阶段,添加节点实例仍需业务离线,811及以上版本可以在线扩容目前推荐升级至8.1.3版本:修复oid回卷问题(参考预警通知)新增在线升级、在线修复cn功能,进一步降低变更对业务影响优化autovacuum及autoanalyze,特性可用加固备份容灾,修复老版本切换不稳定易失败、备份容易导致磁盘满等问题增强熔断措施,避免语句下盘导致磁盘写满等对比8.0.0版本,优化列存小文件,列存升级至2.0版本升级方案获取:升级到8.0.0:https://support.huawei.com/enterprise/zh/cloud-computing/gaussdb-a-pid-250949677?category=installation-upgrade&subcategory=upgrade-guide8.0.0补丁:https://support.huawei.com/enterprise/zh/cloud-computing/gaussdb-a-pid-250949677?category=installation-upgrade&subcategory=patch-installation-guide升级到8.1.1.6或8.1.3.5:https://support.huawei.com/enterprise/zh/cloud-computing/hcs-dws-service-pid-251527524?category=installation-upgrade&subcategory=upgrade-guide
-
问题现象:裸机节点重启后服务自启设置不合理,network和NetworkManage服务冲突,到traffic ip没有绑定上问题根因:本集群为集中式组网BMS集群。vlan配置文件中默认配置了NM_CONTROLLER=no。默认不采用NetworkManager管理网络。当前节点network服务为disable状态,即开机不自启,导致实例重启后network服务为inactive状态,trafficIp未挂载。影响范围:8.1.3版本以前的HCS场景、ARM BMS集群。(euleros2.8版本)*8.1.3版本适配欧拉2.10版本重新制作镜像,已解决上述问题。*针对上述问题,对历史版本镜像排查,发现8.1.3版本以前的HCS场景、ARM BMS基础镜像中network服务为disable状态,对集中式组网场景有影响。问题规避:针对采用8.1.3版本前的BMS镜像,BMS集中式集群现网需要进行上下电操作,或因实例重启后出现实例ip地址丢失场景。1、执行上下电操作前需要执行systemctl status network 查看network服务是否启动,若为inactive服务,执行systemctl restart network 和systemctl enable netwrok。2、若重启实例后出现掉网卡场景,执行ifup bond0.xx查看是否可正常加载ip3、若步骤2操作无法正常拉起网卡,执行systemctl restart network,重启network服务。4.enable network服务,保证重启实例后network正常启动
-
问题现象gaussdb对接hdfs时参数校验阶段报错; controller日志报错Some config items value are invalid问题版本此问题为8.1.1.1版本出现,已在8.1.1.2修复问题分析1、查看controller日志报错Some config items value are invalid;2、查看manager版本和集群版本;3、查看oms节点/opt/huawei/Bigdata/components/current/MPPDB/configurations.xml文件dfs.namenode.kerberos.keytab参数配置,发现配置不对;解决方法1、主备oms节点修改/opt/huawei/Bigdata/components/current/MPPDB/configurations.xml文件dfs.namenode.kerberos.keytab参数配置,将1531行-2213行的scope的值setup修改为all2、修改完之后重启controller,主备oms节点都执行
-
【问题现象】 由于当前版本是8.1.3.300的问题,库与库之间是串行的,所以为了加快速度,可以手动多库并行分布【解决方法】0.创建不带索引的临时表 create table tmp_table like old_table(including all excluding indexes);1.导数据 已完成 外部sql并发导入分区数据2.建索引 按索引并发创建索引3.验业务 已完成4.换表改表名DROP VIEW IF EXISTS ftuser.v_ft_result3;alter table ftuser.ft_result3 rename to ftuser.ft_result3_bak_0814;alter table ftuser.ft_result3_tmp20220813 rename to ftuser.ft_result3;alter table ftuser.ft_result3_std rename to ftuser.ft_result3_std_bak_0814;alter table ftuser.ft_result3_std_tmp20220813_2 rename to ftuser.ft_result3_std;5.重建依赖视图gsql postgresql://:8000/txphw?application_name='OM' -ar -f ft_result3.sql6.客户验证业务7.完成重分步流程 1)表在重分步中无法删除,需要设置:alter tabel xxx set (append_mode=off) 2)drop table xxx; 3)拉起重分步流程nohup gs_expand -t redistribute --redis-mode=insert --dws-mode --parallel-jobs=4 --fast-redis& 查看后台日志保证重分步完成 4)修改管控面状态delete from rds_action where objid={clusterid};nohup gs_expand -t redistribute --redis-mode=insert --dws-mode --parallel-jobs=4 --fast-redis&
-
问题现象:执行 grant select on all tables in schema ...to ... 报错ERROR:NOT-SUPPORT:Not support Grant/Revoke privileges to objects in different nodegroup问题版本:8.1.3.100规避措施:改成单个表赋权规避grant select on rtd_po_header_t to jdbc_dws_sbi_ptp
-
问题现象:1.界面缩容失败2.确定后台是因为锁等待超时导致失败问题版本:《=8.1.3.100分析过程:1.查看缩容日志 cd $GAUSSLOG/om/gs_shrinkxx.log日志2.查看cn-1-1上的gs_redis日志,见在缩容开始1小时左右锁等待超时cd $GAUSSLOG/bin/gs_redis/gs_redisxxxxx.log规避措施:界面重试1.修改cn-1-1上的缩容步骤bat文件,需要修改post_redis为redisvi $PGHOST/shrinkimplphsicalcluster_step/shrinkimplphysicalcluster_step.dat2.客户从界面重入,重新点击缩容重入
-
问题现象: 缩容在界面提交后,右上角提示:“权限不足,请联系技术支持人员(主账号或者具有Security Administrator权限的账号)在当前页面完成对DWS的委托授权”问题版本:内核:8.1.3.100 管控面版本:规避措施:1.联系HC客户权限管理人员给对应用户的用户配配置Security Administrator的用户组2.检查用户权限:统一身份认证--》用户组--》对应赋予权限的用户组--》点击进入查看是否有“Security Administrator”3.确定已经有对应的权限后,再次在界面进行提交
-
【问题现象】用户正常使用的视图,在查询时报视图不存在。在审计日志中,只能查到视图创建行为,无法查到视图删除行为。【排查方法】1. 检查审计开关是否打开audit_enabled2. 检查DDL审计是否打开audit_operation_exec3. 检查视图的审计是否打开audit_system_object,其中二进制的第五位控制视图审计。现场以上功能都正常开启,新建视图再删除,都能被正常审计到。说明视图审计功能被正常打开。4. 检查视图定义,是否有级联删除行为。通过检查视图定义中依赖的对象(视图,表),在审计日志中发现依赖表存在频繁的级联删除行为。【问题根因】级联删除时,上层依赖对象会被删除,且无法记录到审计日志中。【场景分析】1. 用户创建视图依赖的基表1,属于部门A。2. 部门B使用基表1创建视图。3. 部门A经常删除重建基表1,使用级联删除导致部门B的视图也被一起删除。【解决办法】方法一:表重建,改成truncate。避免依赖对象被级联删除。方法二:使用“视图解耦”功能,参数:view_independent。基本原理:开启视图解耦,在删除依赖基表时,视图本身定义并不被删除,处于无法使用状态。待基表被重建,第一次使用视图时,视图会被自动重建。
-
【报错现象】 8361897755 cn_5005 0A000 383087462031697455 [BACKEND] ERROR: The relation "dw_mongo_km_specimen_log_orc_w" has no distribute type. 8361897755 cn_5005 0A000 383087462031697455 [BACKEND] STATEMENT: grant select on all tables in schema mongodb to dataprodmanager 【最小用例】 create user u1 password 'Test_123'; CREATE SERVER hdfs_server FOREIGN DATA WRAPPER HDFS_FDW OPTIONS (type 'hdfs', address 'nohostname:noport',hdfscfgpath 'noconfigpath'); CREATE FOREIGN TABLE dw_mongo_km_specimen_log_orc_w ( id character varying(200), class character varying(200), businessdomain character varying(200), businessmodulename character varying(300), businessmodulecode character varying(200), operationdepartmentcode character varying(200), operationdepartmentname character varying(300), operatorname character varying(300), operationtime timestamp without time zone, operationobjecttype character varying(300), operationobjectvalue text, operationcontent text, operationremark character varying(5000) ) SERVER hdfs_server OPTIONS ( encoding 'utf8', foldername '/dws-data-table/dws_test_write_1y/', format 'orc' ) WRITE ONLY DISTRIBUTE BY HASH(id); grant select on dw_mongo_km_specimen_log_orc_w to u1; 【问题根因】 write only类型外表创建时,不支持指定分布键。 但grant select 时获取分布键报错。 read only 必须指定分布键 ,所以可以grantwrite only 不要求指定分布键(将数据导出到一个文件) 【解决办法】通过拼写SQL过滤掉write only类型外表,单表进行grant授权。
上滑加载中
推荐直播
-
华为云码道Agent集成与鸿蒙实战2026/08/11 周二 19:00-21:00
王一男-华为云码道产品规划专家;李炎-华为云码道产品专家;彭江敏-华为云鸿蒙端云一体化开发专家
本次直播带你解读华为云码道7月份产品新特性、新功能。更有专家演示码道Agent Space × 钉钉机器集成实战,从0到1打通消息通道;码道鸿蒙端云一体化实战,快速搭建员工签到系统。
回顾中 -
华为云开发者AI素养直播课·第五期2026/09/04 周五 16:00-18:00
林华鼎-华为云AI开发者运营负责人;蒋春阳-华为云AI开发者案例开发专家
本期直播内容: AI工具体验营 · 第5-8课连讲。Agent-Team 多智能体协作完成毕业设计实践
回顾中 -
华为云开发者AI素养ClassRoom·第六期2026/09/08 周二 19:00-20:00
樊渊-2026华为软件挑战赛冠军
高手来了:看软挑高手解析二维排样问题—从工业难题到算法突破
回顾中
热门标签