网络
-
PVE直通万兆网卡高负载下载时宿主机直接死机失联,该怎么抓取崩溃日志?
在玩 Homelab 或者企业私有云时,PVE(Proxmox VE)直通万兆网卡(如 Intel X520/X540、Mellanox ConnectX-3/4、Aquantia 等)是压榨网络性能的常见操作。 然而,不少人会遇到一...
-
直通网卡和核显后,OpenWrt热重启导致整机断电死锁的底层原因与终极解决办法
在玩软路由或 “All-in-One” 架构的 Homelab 圈子里,这是一个非常经典但又极度让人抓狂的「硬件级死锁」现象。 表现为:虚拟机(通常是 PVE 或 ESXi)正常运行,一旦你点击 OpenWrt 的「重启」或在后台执行...
-
PVE直通核显给OpenWrt或iKuai导致黑屏死机?一文教你彻底排查与避坑
在折腾 PVE(Proxmox VE)做 AIO(All-in-One)主机的过程中,很多玩家在尝试将 Intel CPU 的核显直通给 iKuai 或 OpenWrt 等虚拟机以实现所谓的“硬件加速”时,经常会遇到 PVE 宿主机直接死...
-
PVE网卡直通绑定失效?一文看懂IOMMU分组拆分与ACS补丁实操
在玩转 Proxmox VE(PVE)做软路由、NAS 或 AIO(All-in-One)系统时, PCIe 硬件直通 几乎是必经之路。但很多人在直通网卡(尤其是多口网卡或板载网卡)时,经常会遇到一个诡异的现象: 一旦把网卡分配给...
-
N100 物理黑群晖吃满 ASPM 与 C10 深层省电的硬核调优指南
很多人选择 Intel N100 制作 NAS,看中的就是它宣称的超低待机功耗。然而在实际物理安装黑群晖(DSM 7.x)后,不少人发现整机空载功耗高达 15W - 20W,CPU 的 Package C-State 只能卡在 C2 或 ...
-
穷玩 HomeLab:双盘位 N100 小主机跑 PVE,怎么用 ZFS 做最低成本的容灾?
在 HomeLab 圈子里,N100 双盘位小主机(比如各类双网口/多网口轻量 NAS、小主机)几乎是性价比的代名词。 但双盘位跑 Proxmox VE (PVE) 会面临一个尴尬的痛点: 如果直接做 ZFS Mirror(镜像),可...
-
N100 小主机 PVE 双网卡直通保姆级教程:不影响宿主机联网与管理的避坑指南
在用 Intel N100 小主机折腾 PVE(Proxmox Virtual Environment)做 AIO(All in One)时,双网卡直通给 OpenWrt/iStoreOS 等软路由系统是提升网络性能、降低 CPU 占用的...
-
N100核显SR-IOV虚拟化:PVE 8.x下Jellyfin与Plex开启QSV硬解保姆级教程
在 PVE 8.x 下,Intel N100 凭借其极低的功耗和出色的 QSV 解码能力,成为了家用 NAS/All-in-One 路由器的明星 CPU。传统的核显直通(Passthrough)只能将核显分给单一虚拟机,而通过 SR-I...
-
PVE核显虚拟化(vGPU/SR-IOV)避坑:如何彻底解决多虚机画面撕裂与串流延迟?
在 Proxmox VE(PVE)下将 Intel 核显(从老一代的 GVT-g 到第 12/13/14 代及 Alder Lake/Raptor Lake 的 SR-IOV)直通给多个虚拟机(VM)使用,是搭建家用高密度云桌面、多路高清...
-
用户态 VFIO 驱动如何实现不依赖内核驱动切换的 PCI 设备热插拔?
在高性能网络和存储领域(如 DPDK、SPDK),为了追求极致的吞吐量和低延迟,通常会将 PCI 设备完全交由用户态驱动(VFIO)接管。 但在实际生产环境中,服务器运行期间动态增加网卡、更换故障硬盘(NVMe)是常态。传统的内核驱动...
-
跑满 NVMe 极限:基于 SPDK 的无锁分布式元数据引擎架构设计
在单盘 NVMe SSD 轻松突破百万级 IOPS、百微秒级延迟的今天,分布式存储系统的性能瓶颈早已不再是底层物理硬件的读写速度,而是软件栈在 CPU 上的开销。 在传统架构中,元数据引擎(如基于内核态文件系统的 RocksDB)在面...
-
解决RocksDB在时序高并发场景下MemTable频繁Flush、WAL积压与写放大的系统性方案
在基于 RocksDB 构建高并发时序数据库(TSDB)时,很多架构师和内核开发人员都会遭遇一个经典的技术「死锁」: 在高吞吐写入下,为了保证写入性能和防止 OOM,系统会频繁触发 MemTable Flush。这看似释放了内存,却直...
-
LSM-Tree 存储引擎如何在 SSD 上实现「写放大」自救?
在现代高并发写入场景中,LSM-Tree(Log-Structured Merge-Tree)凭借其将随机写转化为顺序写的特性,成为了 RocksDB、Cassandra 等主流存储引擎的基石。然而,这种设计天然带来了一个致命的副作用: ...
-
RocksDB 面对大 KV 高频写入直接拉胯?聊聊 Titan KV 分离架构的深水区避坑指南
在传统的 LSM-Tree 架构中,RocksDB 是应对高并发写入的利器。然而,一旦业务场景中出现了 1MB 以上的大 Key-Value(LKV) ,且伴随着 高频写入 ,RocksDB 的写放大(Write Amplificati...
-
动辄百倍写放大?共识协议元数据在 LSM-Tree 中的压缩策略演进
在分布式数据库与一致性协同系统中,基于 Paxos 或 Raft 协议的共识机制是保障数据强一致性的基石。然而,作为状态机驱动的核心,共识协议自身的元数据(如 Raft Log、Current Term、VotedFor、Commit I...
-
Cassandra 5.0 遭遇节点长周期离线,Accord 协议的元数据堆积如何一步步诱发写放大雪崩
在 Apache Cassandra 5.0 中,最令人瞩目的特性莫过于引入了 Accord 协议 (CEP-15)。它通过无主(Leaderless)的一阶段/两阶段共识机制,在不引入外部协调器的前提下,为 Cassandra 带来了...
-
Cassandra 5.0 中的 Accord 事务引擎是如何解决元数据与依赖日志无限膨胀问题的?
作为 Cassandra 5.0 最受瞩目的特性之一,基于 Accord 协议 的全局多 Key 无锁 ACID 事务(CEP-15)彻底改变了 Cassandra 过去只能依靠 LWT(轻量级事务)实现单行一致性的局限。 然而,分...
-
从 EPaxos 到 Accord:分布式共识如何突破 1 RTT 的极限?
在分布式系统领域,传统的强一致性共识算法(如 Multi-Paxos、Raft)通常依赖一个稳定的 Leader。这种设计虽然直观,但在跨地域(Geo-distributed)部署或高并发写入场景下,会暴露出明显的局限性: 网络...
-
嫌 Cassandra 的 Paxos 慢?聊聊如何实现高性能的“无锁”强一致性写入
在分布式数据库领域,Cassandra 一直以极高的写入吞吐量(AP 系统的典范)著称。然而,一旦业务场景要求 强一致性(Linearizability) ,比如余额扣减、唯一性约束,大家的第一反应往往是使用 Cassandra 的轻量级...
-
既然物理时钟不可靠,为什么 Cassandra 依然死磕 LWW(最后写入者胜)?
在分布式系统领域,物理时钟漂移是一个公认的“幽灵”。哪怕你用了 NTP,服务器之间的时钟误差也可能达到几十毫秒甚至更高。 然而,作为经典 AP 系统的代表,Cassandra 却长期将 LWW(Last-Write-Wins,最后写...