规则
-
扫地机器人装机械臂:从清洁工到全能管家,还有多远?
你提出的设想非常迷人——让那个在地上默默转圈的圆盘站起来,“长出”手臂,帮你端茶倒水、整理桌面。这几乎是每个看过《杰森一家》或《哆啦A梦》的人对家用机器人的终极幻想。然而,从“地面清洁”到“多维度空间互助”, 这中间隔着的不是一次简单的硬...
-
不止PTM7950:盘点那些悄然进击笔电/显卡供应链的国产相变导热“黑马”
几年前,“相变导热垫”(Phase Change Thermal Pad)还是莱尔德(Laird)、霍尼韦尔(Honeywell)等国际大厂的专属领域。直到以 PTM7950 为代表的国产高性能型号凭借实测中媲美甚至超越顶级硅脂的表现...
-
AlphaFold 3能否替代传统对接和物理计算?深剖小分子与金属配体预测表现
作为计算化学和药物研发领域近期的最大热点,AlphaFold 3(AF3)将预测范围从单纯的蛋白质拓展到了核酸、小分子配体、金属离子以及化学修饰。这一跨越在学术界和工业界都引起了巨大震动。 但在热闹的宣发背后,我们需要冷静地评估两个核...
-
单GPU多MPI跑GROMACS:如何通过NVIDIA MPS优化性能并彻底避免显存溢出
在利用高性能计算(HPC)集群运行分子动力学模拟时,GROMACS 凭借其对 GPU 的高效支持成为了行业标配。然而,在实际生产环境中,我们经常会遇到这样的尴尬场景: 当模拟的体系较小(如少于 10 万原子),或者 CPU 核心数较...
-
多卡多NUMA服务器性能调优:MPI进程、GPU与MPS守护进程的最优绑定实践
在多卡多NUMA(Non-Uniform Memory Access)架构的服务器上运行MPI(Message Passing Interface)大规模并行程序时,默认的调度策略往往会导致灾难性的性能抖动。 如果一个MPI进程运行在...
-
K8s 混合调度 MIG 与 MPS 的终极实践:把 GPU 榨出最后一滴油水
在 AI 推理服务的生产环境中,最让基础设施团队头疼的,莫过于 “显存闲置” 与 “算力浪费” 。 普通的 AI 推理任务(尤其是中小模型、NLP 分类、OCR、语音识别等)往往呈现“高频、低延迟、低 GPU 利用率”的特点。如...
-
用好 Ragged Batching,解决 Triton 动态批处理中的 NLP 显存爆炸
在生产环境中部署 BERT、GPT 等 NLP 模型时,我们几乎都会开启 Triton Inference Server 的 Dynamic Batching(动态批处理) 。这个功能很香,能把多个客户端的单条请求攒成一个 Batch ...
-
Linux 文件锁的终极纠缠:flock、fcntl、lockf 的本质区别与致命陷阱
在 Linux 多进程或多线程开发中,文件锁(File Locking)是一个绕不开的坎。很多人在遇到进程间同步、防止程序多开、或者写入同一日志文件时,会随便搜一段代码,调个 flock 或者 fcntl 就上线了。 结果往往...
-
如何在非特权(Non-privileged)容器中,安全部署基于 SPDK 与 AF_XDP 的 K8s 高性能网络?
在 Kubernetes 节点上部署基于 SPDK (Storage Performance Development Kit) 和 AF_XDP (Address Family XDP) 的高性能网络或存储组件时,传统的做法通常是...
-
多云跨VPC网络下,Cilium BGP与Istio联动的NodePort流量容灾路径设计
在多云、跨 VPC 的混合云架构中,企业往往受限于云厂商的负载均衡器(LoadBalancer)跨界限制或昂贵的专线/网关成本,选择通过 Cilium BGP + 物理/虚拟路由器 直接宣告 Kubernetes 节点路由,并结合 ...
-
嫌 Cassandra 的 Paxos 慢?聊聊如何实现高性能的“无锁”强一致性写入
在分布式数据库领域,Cassandra 一直以极高的写入吞吐量(AP 系统的典范)著称。然而,一旦业务场景要求 强一致性(Linearizability) ,比如余额扣减、唯一性约束,大家的第一反应往往是使用 Cassandra 的轻量级...
-
从 EPaxos 到 Accord:分布式共识如何突破 1 RTT 的极限?
在分布式系统领域,传统的强一致性共识算法(如 Multi-Paxos、Raft)通常依赖一个稳定的 Leader。这种设计虽然直观,但在跨地域(Geo-distributed)部署或高并发写入场景下,会暴露出明显的局限性: 网络...
-
TiKV Titan 存储引擎应对 SSD 硬件空洞与文件系统碎片的深层优化实践
在 TiDB/TiKV 的大规模生产实践中,为了应对大 Value 带来的写放大问题,我们通常会开启 Titan 存储引擎。Titan 通过 KV 分离 (Key-Value Separation)将大 Value 从 LSM-tree...
-
PVE 8.0下Intel 12代及以上核显SR-IOV虚拟化实操教程(保留宿主机HDMI输出)
在 Intel 11 代之前的消费级平台上,我们常用 GVT-g 技术来对核显进行分片虚拟化。但从 12 代(Alder Lake)及以后的架构(包括 N100、i3-12100、i7-13700 等)开始,Intel 彻底废弃了 GVT...
-
N100核显SR-IOV虚拟化:PVE 8.x下Jellyfin与Plex开启QSV硬解保姆级教程
在 PVE 8.x 下,Intel N100 凭借其极低的功耗和出色的 QSV 解码能力,成为了家用 NAS/All-in-One 路由器的明星 CPU。传统的核显直通(Passthrough)只能将核显分给单一虚拟机,而通过 SR-I...
-
N100 平台 PVE 8 开启核显 SR-IOV 后的整机功耗实测与深度调优指南
在低功耗小主机和 NAS 界,Intel N100 凭借 4 个 Alder Lake-N 核心和 24EU 的 Xe 核显,直接成为了新一代的「神U」。而 Proxmox VE (PVE) 作为家用虚拟化平台的首选,配合 SR-IOV...
-
PVE网卡直通绑定失效?一文看懂IOMMU分组拆分与ACS补丁实操
在玩转 Proxmox VE(PVE)做软路由、NAS 或 AIO(All-in-One)系统时, PCIe 硬件直通 几乎是必经之路。但很多人在直通网卡(尤其是多口网卡或板载网卡)时,经常会遇到一个诡异的现象: 一旦把网卡分配给...
-
直通网卡和核显后,OpenWrt热重启导致整机断电死锁的底层原因与终极解决办法
在玩软路由或 “All-in-One” 架构的 Homelab 圈子里,这是一个非常经典但又极度让人抓狂的「硬件级死锁」现象。 表现为:虚拟机(通常是 PVE 或 ESXi)正常运行,一旦你点击 OpenWrt 的「重启」或在后台执行...
-
高并发下 nf_conntrack: table full 报错?教你精准计算内核参数,拒绝内存崩溃
在高并发网络压力测试或遭遇 DDoS 攻击时,Linux 服务器的 dmesg 或者是 /var/log/messages 经常会爆出这样一条红字警告: nf_conntrack: table full, dropping ...
-
榨干最后一瓦:软路由万兆网卡 ASPM 节能保姆级开启与调优指南
在玩软路由和家庭服务器(All in One)的圈子里,万兆网卡(10G NIC)几乎是标配。然而,很多人在把网卡插上、网线接通之后,往往会忽略一个隐形的主机“电费刺客”——PCIe 功耗。 由于万兆网卡(尤其是电口网卡,如 Inte...