只是一个默认分类
租来的 GPU 实例多数跑在容器和 NAT 网络后面,对外只开一个高位 SSH 端口,控制台上并没有一排随你勾选的端口。所以"端口映射"在实际操作里是两条路:SSH 本地端口转发(隧道)——不在公网上多开任何端口,本地浏览器访问 http://127.0.0.1:端口 就直达实例里的服务。第一次跑通、自己一个人用、调试阶段,选这条。平台公网端口映射——...
在 GPU 云服务器上跑训练或推理任务时,Jupyter Lab / Notebook 是最常用的交互式开发环境。但云端启动 Jupyter 和本地开发有几个关键差异:需要远程访问、要考虑安全性、SSH 断开后进程可能终止,以及按小时计费时关机和销毁对费用的影响不同。这篇文章给出在租用的 GPU 实例上启动 Jupyter 并安全连接的标准做法,以及如...
刚租下一台 GPU 实例,控制台给你一串 IP、一个端口号、一个用户名,可能还有一个 .pem 或 .key 文件。接下来要做的就一件事:把终端连上去。命令本身只有一行,真正卡住人的是私钥权限、非默认端口,以及换了一台机器之后本地 known_hosts 报警。下面按实际操作顺序走一遍。先把这一行跑通ssh -p <端口> -i <私...
先问自己要跑什么任务租云 GPU 之前,先明确交付目标:是对外提供高并发 API 推理服务,还是自己做创意生图生视频,或是写代码做微调实验,还是批量转写音频?任务性质直接决定镜像模板的类型。生产级大模型推理或高并发 API 服务:直接选 vLLM 或 TGI(Text Generation Inference)镜像。这类镜像预编译好 PagedAtte...
为什么 FLUX.1 在 ComfyUI 里容易爆显存FLUX.1(dev 或 schnell)采用约 120 亿参数的 Diffusion Transformer 架构,全精度(FP16/BF16)权重文件本身就需约 24GB 显存。加载后还要同时运行体积接近 10GB 的 T5-XXL 文本编码器,以及在高分辨率解码阶段调用 VAE,峰值显存需求轻...
0 条留言