<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:content="http://purl.org/rss/1.0/modules/content/">
  <channel>
    <title>📕 运维 on 时光纪念馆</title>
    <link>https://www.soulmap.cn/posts/ops/</link>
    <description>Recent content in 📕 运维 on 时光纪念馆</description>
    <generator>Hugo -- gohugo.io</generator>
    <language>zh</language>
    <lastBuildDate>Tue, 09 Jun 2026 17:37:09 +0800</lastBuildDate><atom:link href="https://www.soulmap.cn/posts/ops/index.xml" rel="self" type="application/rss+xml" />
    <item>
      <title>sqlserver数据库事物日志收缩</title>
      <link>https://www.soulmap.cn/posts/ops/sqlserver-log-ss/</link>
      <pubDate>Tue, 09 Jun 2026 17:37:09 +0800</pubDate>
      
      <guid>https://www.soulmap.cn/posts/ops/sqlserver-log-ss/</guid>
      <description>同事A： 我刚做了个大表的备份，导致事务日志暴涨，空间快爆了，帮我处理下。 我： .... 1、看看啥情况 登录上去看，D盘只剩7G多，还好这个业务系统数据不怎么增长。 查看数据库的日志空间使用情况： dbcc sqlperf(logspace) 看到有个数据库的日志空间很大，使用99%多了。 2、怎么办 要降空间，只能做备份了。查看下这个数据</description>
    </item>
    
    <item>
      <title>Vmware环境下的windows关闭时间同步</title>
      <link>https://www.soulmap.cn/posts/ops/vm-windows-times-closesync/</link>
      <pubDate>Tue, 06 Jan 2026 15:38:08 +0800</pubDate>
      
      <guid>https://www.soulmap.cn/posts/ops/vm-windows-times-closesync/</guid>
      <description>有时候我们需要关闭windows的时间同步，但是在VMware环境下，时间同步不止是windows本身的时间同步，还有VMware的虚拟时间同步及硬件时间同步。 下面以关闭windows server 2016的时间同步为例，详细介绍需要进行的操作。 1、关闭Windows自带的时间同步 打开服务，</description>
    </item>
    
    <item>
      <title>ORACLE RMAN 恢复介绍 （基于NBU备份）</title>
      <link>https://www.soulmap.cn/posts/ops/oracle_rman_recovery/</link>
      <pubDate>Wed, 26 Mar 2025 17:05:27 +0800</pubDate>
      
      <guid>https://www.soulmap.cn/posts/ops/oracle_rman_recovery/</guid>
      <description>一、RMAN 恢复介绍 一般我们使用RMAN恢复，主要有如下两种方式： 全量恢复，可以恢复到指定时间点，也可以不指定时间，默认恢复到控制文件里存在的最后一个归档日志。 场景： 一般情况下，我们不会直接恢复主库（也就是备份的这个库），而是恢复到一个临时库。当然，如果主库已经不可用，那就直接恢</description>
    </item>
    
    <item>
      <title>K8S环境下的jenkins 内存不足问题</title>
      <link>https://www.soulmap.cn/posts/ops/jenkins-outofmemory/</link>
      <pubDate>Wed, 27 Nov 2024 17:20:37 +0800</pubDate>
      
      <guid>https://www.soulmap.cn/posts/ops/jenkins-outofmemory/</guid>
      <description>今天接到一个报障，说在灵雀云平台上跑流水线报了个内存不足的错误，开发照过来让帮忙看看。看了一眼报错，判断并不是主机的内存不足，而是jenkins的内存不足。报错截图如下： 开发说不会处理，让帮忙看看。但是我也不熟悉灵雀云上的这套devops的环境，本来不想管的，不过刚好心情好，就帮</description>
    </item>
    
    <item>
      <title>Maxta超融合控制台异常解决</title>
      <link>https://www.soulmap.cn/posts/ops/maxta-console-config/</link>
      <pubDate>Thu, 05 Sep 2024 15:04:00 +0800</pubDate>
      
      <guid>https://www.soulmap.cn/posts/ops/maxta-console-config/</guid>
      <description>背景 之前云桌面使用的Maxta超融合，后面换成了思科超融合，这两套就移交过来坐业务测试了。我把这些主机添加到我业务这边的VC并配置好，测试了虚拟机创建都正常就没管了。 问题描述 因为maxta集群出现部分虚拟机报没有空间写入的问题，要排除下这个问题想要登陆控制台查看，发觉控制台无法登</description>
    </item>
    
    <item>
      <title>kafka 队列深度异常导致日志收集出现缺少</title>
      <link>https://www.soulmap.cn/posts/ops/kafka-topic-question/</link>
      <pubDate>Tue, 03 Sep 2024 14:24:11 +0800</pubDate>
      
      <guid>https://www.soulmap.cn/posts/ops/kafka-topic-question/</guid>
      <description>问题描述 业务侧反馈了一个诡异问题，有些日志通过容器的实时日志能够查到，但是通过聚合日志界面却找不到。而且找不到的还是时间比较前的，过了很久再查也是查不到，感觉是丢失了。 环境描述 环境是灵雀云，聚合日志功能是灵雀云自带的，跟日志组件相关的架构图如下： 问题排除 检查了kafka服务、la</description>
    </item>
    
    <item>
      <title>Sqlserver数据库账号同步</title>
      <link>https://www.soulmap.cn/posts/ops/sqlserver-sync-user/</link>
      <pubDate>Wed, 24 Jul 2024 14:07:47 +0800</pubDate>
      
      <guid>https://www.soulmap.cn/posts/ops/sqlserver-sync-user/</guid>
      <description>Sqlserver 账号同步问题 使用alwayson架构的sqlserver数据库，在主备切换时可能会出现以下与账号有关的问题： 1. 账号密码不对，导致无法登陆。 2. 账号权限出现丢失，没法正常打开数据库。 第一个问题，很大的可能是用户创建账号时只在当时的主节点上创建了，另外一个节点没有创建。 第二个问题，是</description>
    </item>
    
    <item>
      <title>Sqlserver 表空间容量问题</title>
      <link>https://www.soulmap.cn/posts/ops/sqlserver-table-disksize/</link>
      <pubDate>Tue, 09 Jul 2024 11:06:04 +0800</pubDate>
      
      <guid>https://www.soulmap.cn/posts/ops/sqlserver-table-disksize/</guid>
      <description>1、查询表空间占用的磁盘空间 一般我们使用微软提供的 SQL Server Management studio 工具连接数据库。这个工具提供了方便查看表空间占用情况的功能。具体如下： 查询后的结果示例如下： 对上面表的各列作一个介绍： 记录数： 即表里面有多少条数据； 保留(KB): 表占用磁盘空间的大小，单位是KB 数据(KB): 表的数据占用空</description>
    </item>
    
    <item>
      <title>记一次nutanix超融合cvm 启动失败故障</title>
      <link>https://www.soulmap.cn/posts/ops/nutanix-cvm-ssh/</link>
      <pubDate>Mon, 04 Mar 2024 09:28:00 +0800</pubDate>
      
      <guid>https://www.soulmap.cn/posts/ops/nutanix-cvm-ssh/</guid>
      <description>1、故障描述 因为维护原因，需要重启Nutanix集群一个节点的CVM，该集群的控制平台（Prism管理平台）也部署在该节点。节点重启后控制平台无法登陆。登陆该cvm节点查看，发现很多服务都没有启动。 2、初步分析 通过登陆集群的其它cvm主机，执行命令查看节点状态： #cluster status ... CVM: 10.1.8.148 Down ... 确认</description>
    </item>
    
    <item>
      <title>ORCLE SQL不绑定变量导致的性能问题</title>
      <link>https://www.soulmap.cn/posts/ops/oracle-pool-sqlspeed/</link>
      <pubDate>Fri, 23 Feb 2024 13:58:25 +0800</pubDate>
      
      <guid>https://www.soulmap.cn/posts/ops/oracle-pool-sqlspeed/</guid>
      <description>1、 概念 1.1 SQL 执行过程简介 执行sql的过程，会将sql的文本进行hash运算，得到对象的hash值，然后拿hash值，去Hash Buckets里遍历缓存对象句柄链表，找到对应的缓存对象句柄，然后就可以得到缓存对象句柄里对应sql执行计划、解析树等对象，所以执行相同的sql第二次执行</description>
    </item>
    
    <item>
      <title>ORACLE 18C 监听配置问题</title>
      <link>https://www.soulmap.cn/posts/ops/oracle-listen-18c/</link>
      <pubDate>Wed, 21 Feb 2024 18:04:10 +0800</pubDate>
      
      <guid>https://www.soulmap.cn/posts/ops/oracle-listen-18c/</guid>
      <description>最近碰到一个ORACLE 18c上面的PDB的监听问题，折腾了好久没成功，找了专业DBA协作才搞定。故整理和记录下。 1. 监听参数 ORACLE跟监听相关的几个参数： SQL&amp;gt; show parameter listen; NAME TYPE VALUE ------------------------------------ ----------- ------------------------------ forward_listener string listener_networks string local_listener string LISTENER_ORADB remote_listener string 几个参数的含义： LOCAL_LISTENER 本地侦听器 REMOTE_LISTENER 用于远程侦听器，如果有的话 FORWARD_LISTENER 为转发侦听器 listener_networks 当rac加入</description>
    </item>
    
    <item>
      <title>ceph osd 配置内存限制</title>
      <link>https://www.soulmap.cn/posts/ops/ceph-osd-memory-limit/</link>
      <pubDate>Tue, 23 Jan 2024 16:27:52 +0800</pubDate>
      
      <guid>https://www.soulmap.cn/posts/ops/ceph-osd-memory-limit/</guid>
      <description>Ceph 的 osd 进程默认情况下是没有做内存限制的，会尽可能使用系统的内存来提高性能，所以很容易出现 Out of memory 从而被系统杀死进程的情况。 生产环境为了保证OSD的稳定，一般需要限制其内存。具体限制多少视主机内存而定，内存越高，性能越好。 首先查看我们的osd的情况 myceph@t-ceph-deploy:~/ceph-cluster$ ceph osd tree ID CLASS WEIGHT TYPE NAME STATUS REWEIGHT PRI-AFF -1 21.00000 root default -3 3.00000</description>
    </item>
    
    <item>
      <title>K8S CKS认证考试内容分析 --Part 3</title>
      <link>https://www.soulmap.cn/posts/ops/k8s-cks-exam-3/</link>
      <pubDate>Thu, 04 Jan 2024 12:03:38 +0800</pubDate>
      
      <guid>https://www.soulmap.cn/posts/ops/k8s-cks-exam-3/</guid>
      <description>9、网络策略（二） Task 创建一个名为 pod-restriction 的 NetworkPolicy 来限制对在 namespace dev-team 中运行的 Pod products-service 的访问， 只允许以下 Pod连接到 Pod products-service - namespace qaqa 中的 Pod - 位于任何namespace，带有标签 environment testing 的Pod 注意:确保应用 NetworkPolicy。 你可以在/cks/net/po.yaml 我到一个模板清单文件 清单文件就没啥内容</description>
    </item>
    
    <item>
      <title>K8S CKS认证考试内容分析 --Part 4</title>
      <link>https://www.soulmap.cn/posts/ops/k8s-cks-exam-4/</link>
      <pubDate>Thu, 04 Jan 2024 12:03:38 +0800</pubDate>
      
      <guid>https://www.soulmap.cn/posts/ops/k8s-cks-exam-4/</guid>
      <description>13、容器安全上下文 Context Container Security Context 应在特定 namespace 中修改 Deployment。 Task 按照如下要求修改 sec-ns 命名空间里的 Deployment secdep 一、用 ID 为 30000 的用户启动容器（设置用户 ID 为: 30000） 二、不允许进程获得超出其父进程的特权（禁止 allowPrivilegeEscalation） 三、以只读方式加载容器的根文件系</description>
    </item>
    
    <item>
      <title>K8S CKS认证考试内容分析 --Part 2</title>
      <link>https://www.soulmap.cn/posts/ops/k8s-cks-exam-2/</link>
      <pubDate>Tue, 02 Jan 2024 10:27:48 +0800</pubDate>
      
      <guid>https://www.soulmap.cn/posts/ops/k8s-cks-exam-2/</guid>
      <description>5、审计日志 Task 在 cluster 中启用审计日志。为此，请启用日志后端，并确保： - 日志存储在 /var/log/kubernetes/audit-logs.txt - 日志文件能保留 10 天 - 最多保留 2 个旧审计日志文件 /etc/kubernetes/logpolicy/sample-policy.yaml 提供了基本策略。它仅指定不记录的内容 注意:基本策略位于cluster 的master 节点上。 编辑和扩展基本策略以记录: - RequestResponse 级别的 persistentvolumes 更改 - namespace front-apps 中 configmaps 更改的请求</description>
    </item>
    
    <item>
      <title>K8S CKS认证考试内容分析 --Part 1</title>
      <link>https://www.soulmap.cn/posts/ops/k8s-cks-exam-1/</link>
      <pubDate>Thu, 28 Dec 2023 17:03:33 +0800</pubDate>
      
      <guid>https://www.soulmap.cn/posts/ops/k8s-cks-exam-1/</guid>
      <description>前言 去年黑五买了cka和cks的认证考试套餐（实在是便宜，多个cks也就多500块），cka已经高分考过了，想着卷快到期了要把cks也考了，不要浪费。然后像cka一样，先去官网考试里的模拟考测试一番，把试题内容和答案下载下来复习了几遍，自认学习得不错，第二次模拟考机会也是高分通过</description>
    </item>
    
    <item>
      <title>K8S镜像pull提示认证失败问题</title>
      <link>https://www.soulmap.cn/posts/ops/k8s-imagepullsecret/</link>
      <pubDate>Thu, 28 Dec 2023 15:26:02 +0800</pubDate>
      
      <guid>https://www.soulmap.cn/posts/ops/k8s-imagepullsecret/</guid>
      <description>1、问题描述 通过K8S集群部署应用时，时常会遇到pod的状态是ImagePullBackOff 或 ErrImagePull，查看pod的事件可以看到类似如下提示： Warning Failed 65s (x4 over 2m40s) kubelet Failed to pull image &amp;#34;tharbor.timesgroup.cn/chenhq/nginx-web1:v3&amp;#34;: rpc error: code = Unknown desc = Error response from daemon: unauthorized: unauthorized to access repository: monitor/node-exporter, action: pull: unauthorized to access repository: monitor/node-exporter, action: pull 2、问题分析 出现这种情况说明是pod去har</description>
    </item>
    
    <item>
      <title>网络连接被阻止-windows</title>
      <link>https://www.soulmap.cn/posts/ops/windows-network-refuse/</link>
      <pubDate>Thu, 07 Dec 2023 15:38:08 +0800</pubDate>
      
      <guid>https://www.soulmap.cn/posts/ops/windows-network-refuse/</guid>
      <description>一、现象 外网连公司内部的一个sftp服务失败，提示如下： kex_exchange_identification: read: Connection reset by peer Connection reset by xxxx port 21888 Connection closed. Connection closed 二、初步排除 首先检查网络连通性，发现ping正常，但是telnet连接上后立刻断开，如下： $ telnet xxxxx 21888 Trying xxxxx... Connected to xxxxx. Escape character is &amp;#39;^]&amp;#39;. Connection closed by foreign host. 根据经验，请求已经到达了服务端，但是因为某些原因服务端把其连接给中</description>
    </item>
    
    <item>
      <title>k8s的账户管理和授权</title>
      <link>https://www.soulmap.cn/posts/ops/k8s-user-and-sa/</link>
      <pubDate>Tue, 28 Nov 2023 08:53:59 +0800</pubDate>
      
      <guid>https://www.soulmap.cn/posts/ops/k8s-user-and-sa/</guid>
      <description>一、K8S账户管理 账户管理分为： userAccount 与 serviceAccount userAccount: 通常是给人设计使用的，并且不在k8s集群内管理，所以无法使用kubectl进行创建。 serviceAccount: 通常是为集群内pod，外部service访问而设计的，更轻量级，更专注与实现某个任务。属于K8S集群管理，所以可以使用kubectl命令创建。 k8s账户管</description>
    </item>
    
    <item>
      <title>K8S强制删除资源</title>
      <link>https://www.soulmap.cn/posts/ops/k8s-delete-force/</link>
      <pubDate>Wed, 22 Nov 2023 11:12:13 +0800</pubDate>
      
      <guid>https://www.soulmap.cn/posts/ops/k8s-delete-force/</guid>
      <description>1、强制删除命名空间 删除命名空间是危险操作，删除后命名空间下的所有资源都会丢失，请务必确认清楚！ 首先，尝试使用--force选项删除。 # kubectl delete ns gatekeeper-system --force 如果不行，则需要通过以下方法删除。 # k get ns gatekeeper-system NAME STATUS AGE gatekeeper-system Terminating 6h10m # k get ns gatekeeper-system -o json &amp;gt;gatekeeper.json #vi gatekeeper.json ##删除下面内容 21 &amp;#34;spec&amp;#34;: { 22 &amp;#34;finalizers&amp;#34;: [ 23 &amp;#34;kubernetes&amp;#34; 24 ] 25 }, #kubectl proxy ## 启动一个ku</description>
    </item>
    
    <item>
      <title>example</title>
      <link>https://www.soulmap.cn/posts/ops/read/</link>
      <pubDate>Thu, 05 May 2022 00:18:06 +0800</pubDate>
      
      <guid>https://www.soulmap.cn/posts/ops/read/</guid>
      <description></description>
    </item>
    
  </channel>
</rss>
