没玩过HPC,不过以下图片应该可以实现?自己写个python或者bash submitter把srun sbatch的输出导出到vps或者笔记本
不应该是localhost 1234吗 为什么你给的url是dest port
实际上感觉你用claude + python + react搓一个前后端分离的deployment比你在这里debug gradio有效率多了
什么应该是localhost?不懂你在说什么。你还是先read the friendly manual吧,或者让AI给你解释一下…
Edit: 我也得自我反省,特此为我的语气表示抱歉。我的耐心不足,只够告诉小林正解,懒得和其他人解释其他解法错在哪、为啥某几个方法根本不可能work(除非真是prospective PhD/在读,得手把手babysit)。还是让AI代劳吧。让AI读完 ssh(1) - OpenBSD manual pages 的-L部分再给你解释就行。
-L[bind_address:]port:remote_socket
确实有个typo,fixed,多谢抓虫。(我猜林桑自己写的时候已经反应过来了改对了)
TIL [bind_address:] 原来是可以空着不写的
如果这个project是要给其他人用的话ssh proxy还是有点麻烦了倒是
我以前的解法是套个middleware写html和js的path rewrite
ws也应该是一样的道理 直接proxy过去接收path 但其实更方便的应该是直接套个nginx算了
你买张机票去手把手喂饭吧 ![]()
那得小林给口一发,反正realtrump和real林克臣是一个风格
太感谢了,前辈和学校专门管HPC的specialist一样强。
python gradio_app.py --server-name gl1502.arc-ts.umich.edu --server-port 7860
然后直接本机
ssh [email protected] -L 1234:gl1502.arc-ts.umich.edu:7860
然后
就好了
在解决了一个grounding dino的cuda问题之后web gui版本的pipeline完美开跑了
现在就是要优化一下pipeline流程和加速,现在一张照片处理就要1000秒,还是在A40上。
Why are you debugging this at 2am? You have no life? ![]()
太好了,问题解决了就好。养成半夜1am-2am是debug黄金时段的好习惯,搞搞vllm,加速感情破裂,很快就能等到1000秒被优化到了100毫秒的好消息。
可能是因为
2am的泥潭,别人在讨论4i,小林后援团却在讨论-R和-L。
其实用-D应该也行,更省事
4090跑local模型能比M3 Ultra挂壁吗?
小林咋开着托福的帖子
太感谢了 现在去见导师了
高中时候加的tag
Why am I orbiting 小林?
The silence actually lets me miss you a little.
泥潭吸引我半夜在飞机上还打字回复这个帖子,完全是因为其他人给的答案都不对
xkcd 386
Disclaimer: 我完全没用过gradio,最多在hf见过两次界面,只是老中医云把脉而已
@Shetao 赛博塔罗

