今天四月的时候公司领导说要全面推行 AI 增效工作,那个时候外界天天被 openclaw 炒得热火朝天。我当时也想试试龙虾的话但我那天在知乎文章测评中就被那个 hermes 的特性吸引住了,毕竟有长期记忆和自动做技能这工作更加适合我在公司的工作流。所以我就折腾了四个月,也真他吗痛苦。 ## 模型选择 由于我的工作流太多涉及政务相关的内容,我不敢用线上模型,用着公司的 5090 显卡装了个 LM Studio 去跑私有 LLM 模型,截止现在已经决定长期用 `ornith-1.0-35B-MoE` 了,除非后面有更牛逼的。 在此之前.....

阅读全文...

## 背景 我当前工作的云平台是有专区的,云平台是专用的 10 段的内网地址,而对外出口是用 17 段的,是在我们的防火墙做SNAT和DNAT做互通的。当初我们有个需求需要跨网络备份源主机,并把数据恢复到本地机房。跨网的话需要配置跳板机和作业的回调地址,我都需要回调到 17 段的地址才能备份用户源端的主机。 信息是这样的 - 源端IP地址:17.111.111.100; - 备份平台地址:10.10.230.15; - 备份平台对外映射地址:17.111.45.234; - LiveCD的云主机地址:10.10.31.3 .....

阅读全文...

## 背景 之前我们云的服务器拿来搞深信服安全资源池和存储服务器,都是浪潮的信创服务器,型号好像是CS5260H。在今年我们在做维护升级的时候都会出现同样的问题,就是重启后管理口就连不上了。我们都是断电放置 5 分钟开机才可以恢复,但还是做个记录吧。 ## 触发条件 1. 服务器突然断电重启或按了重启键; 2. 服务器维护系统自动重启后; ## 排查过程 排查过程我就不写废话了,直接说过程吧 ### 1. 确认管理口能不能认出来 先看看 `dmesg | grep Ethernet`,发现是可以认得出光口和电.....

阅读全文...

我们这边有个需求,虽然 Zabbix-Agent 可以获取所有分区的空间利用率的监控项,但是我们需要将服务器的所有数据对接到上游的监管系统,监管平台的厂商说为了确保唯一性,我们提供给他们的数据一定要有所有分区的 UUID。这可把我整蒙了,他们不能自己生成一个 UUID 嘛?这个需求也是冷门需求反正我谷歌也没类似的案例,只能靠自己了。 ## 不使用自定义监控项的方法 经过我占用了 3 小时工时的研究下,在不做自定义监控项且不运行系统命令 (system.run 监控项是默认关闭也不可能开启的) 的情况下,只能读取 `/etc/fstab`.....

阅读全文...

明明有 Prometheus 了,为什么要需要用 Zabbix 做监控,还要拖他的数据?这不是牛头人吗?你说得对,不是所有人都玩懂所有监控平台,而且我管理团队都是尽可能降低大家的操作门槛,能用 Zabbix 就用 Zabbix 吧,至少界面没那么抽象。虽然可以把数据集成到 Grafana 并实现告警,但我是 oldschool,能集成在一个平台那肯定最好的! ## 大佬们的教程 其实网络上已经有很多 Zabbix 拖 Prometheus 数据的教程,这些大佬的教程已经说得很够了,所以文本不复述了,我也是抄作业的,这里先放几个之前参.....

阅读全文...

现在我的工作所接触的服务器和操作系统都是国产信创环境的,用起来跟用 CentOS 没什么不同。由于一直在用堡垒机来来部署环新系统的环境,玩不了 ansible(都白名单了)也不敢玩脚本,所以很多配置基本都是手敲(手敲好啊,我最喜欢在办公室敲键盘比大家说话还大声,慢慢部署还能凑工时)。但我记性不是很好,有新的云主机布置环境还要查这查那,所以还是写一份备忘录比较好。 ## 操作系统 我一般都在用 `银河麒麟服务器端 V10 SP3` 做底层系统,操作上跟 CentOS 没有明显区别。 ```bash # 关闭图形化界面(有些同事分配.....

阅读全文...

去了新公司参与监控运维平台的建设,我都差不多搞定了 Zabbix 的搭建和系统纳管了。正准备弄个 Grafana 给领导看监控大屏来表现价值,开开心心要做面板的时候突然报错了,选好监控项的时候一直 `no data`。看了下 Query 发现返回的数据报错了,报错内容是 `Error: json: invalid use of ,string struct tag, trying to unmarshal unquoted value into int64`。 ![](https://cos.lowb.ren/typecho/upload.....

阅读全文...