正在核验节点域
当前:HMY 四卡。部署、停止和进程分别控制;工作量统一计入两台主机总账。
HMY 总览
本机 Linux · Tailscale · HMY
—
GPU 一览
全局工作量
快捷控制
GPU 看板
实时利用率、显存、功率与温度
GPU 进程
nvidia-smi 只读采样 · 用户、PID 与显存占用
当前进程
工作量账本
按节点域和账本范围读取;本机保持独立账本
正在同步两台主机…
合计有效工作量 · 含运行中
正在读取数据库已结算历史
按两台主机合计工作量判断 45% / 55% 死区;自动卡至少驻留10分钟,每次最多调整一张,手动固定优先。工作量平衡不代表实际到账金额完全相等。
主机贡献
每卡工作量 · 本轮累计
跨重启累计 · 15 秒刷新最近记录
本机 本地数据库任务管理
部署、调度与远端清理
当前任务
—运行控制
部署新任务
启动前检查
先检查 GPU,再勾选空闲卡或占用卡排队。实际启动仍须通过所选 compute 模式与资源准入。
默认地址遵循累计工作量 45/55 调度;固定 A/B 的卡不会被自动切换。检测只检查当前启动条件,部署时会再次预检。
运行中的任务不会被覆盖。结束后远端自动清理本轮私有目录,并将报告回收到 本机。
运行参数与流量
启动门槛调整 · 代理流量统计
工作负载调度模式
—调度模式与 GPU compute 准入、显存预留、停止方式和定时/见缝插针控制彼此独立,保存后下一次部署生效。
GPU 运行模式与启动条件
—选择本机的运行模式,保存后下一次部署生效。各节点分别保存;本轮实际策略显示在下方。
启动所需空闲显存 = worker 实际占用(实测约 12608 MiB)加余量;13700 MiB 是启动前容量要求。
每卡显存预留
正在核验能力
日志与实际版本
等待读取
等待读取
代理流量统计
—统计该机经代理链路隧道的全部流量:计算工作进程直连分布式计算服务端的连接、探测、诊断,凡走代理服务商的都算;控制面 SSH 不走代理服务商所以不计。每 5 分钟采样一次同步(非实时监控),速率为最近一个采样间隔的平均值;节点倍率与扣费以代理服务商后台为权威口径。
流量日历:点某一天,看当天所选节点每小时的消耗。每 5 分钟采样一次汇总。
每日 GPU 停机时间
—按所选节点实际库存和北京时间统计本项目 worker 未运行的分钟数。每分钟刷新;监控缺失的时段单独标为未记录,不算成运行或停机。日历显示所选节点停机分钟数之和,点日期查看每张卡。