news 2026/7/26 6:32:11

FoundationPose使用说明

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
FoundationPose使用说明
1、配置cuda环境如下
dengwei@youdao:~$ nvidia-smi Fri Dec1914:48:022025+---------------------------------------------------------------------------------------+|NVIDIA-SMI535.183.01 Driver Version:550.54.14 CUDA Version:12.4||-----------------------------------------+----------------------+----------------------+|GPU Name Persistence-M|Bus-Id Disp.A|Volatile Uncorr. ECC||Fan Temp Perf Pwr:Usage/Cap|Memory-Usage|GPU-Util Compute M.||||MIG M.||=========================================+======================+======================||0NVIDIA GeForce RTX3060Off|00000000:01:00.0 On|N/A||35% 31C P8 10W / 170W|3MiB / 12288MiB|0% Default||||N/A|+-----------------------------------------+----------------------+----------------------+ +---------------------------------------------------------------------------------------+|Processes:||GPU GI CI PID Type Process name GPU Memory||ID ID Usage||=======================================================================================||No running processes found|+---------------------------------------------------------------------------------------+ dengwei@youdao:~$ nvcc -V nvcc: NVIDIA(R)Cuda compiler driver Copyright(c)2005-2021 NVIDIA Corporation Built on Sun_Mar_21_19:15:46_PDT_2021 Cuda compilation tools, release11.3, V11.3.58 Build cuda_11.3.r11.3/compiler.29745058_0 dengwei@youdao:~$ls/usr/local/ bin cuda-11.3 cuda-12.2 games lib protobuf-3.11.4 share sunlogin tensor.tar.gz cuda cuda-12.1 etc includemansbin src TensorRT-10.8.0.43 zed dengwei@youdao:~$ ll /usr/local/cuda lrwxrwxrwx1root root20111123:36 /usr/local/cuda ->/usr/local/cuda-11.3/
2、参考博客安装foundationPose

https://blog.csdn.net/zml2973002937/article/details/149842806
下载镜像wenbowen123/foundationpose可能不顺利,可以导出本电脑的镜像,之后导入目标设备中;也可以将本电脑正在运行的容器导出来,导入到目标设备,这样容器不用再编译环境,导入运行即可用。镜像或容器的导出导入参考博客:
https://blog.csdn.net/qq_25735431/article/details/143256770

以下是我用的一些安装命令

# git下载FoundationPose代码cd/home/dengwei/PoseDetect/gitclone https://github.com/NVlabs/FoundationPose.git# docker下载镜像cd~ docker pull wenbowen123/foundationpose&&docker tag wenbowen123/foundationpose foundationpose# 配置docker容器内可打开GUI界面dengwei@youdao:~$ xhost +local:root# 使用镜像启动容器dengwei@youdao:~$ docker run -it --gpus all --name foundationpose\-eDISPLAY=$DISPLAY\--envQT_X11_NO_MITSHM=1\-v /home/dengwei/PoseDetect/FoundationPose:/workspace/FoundationPose\-v /tmp/.X11-unix:/tmp/.X11-unix:rw\-v ~/.Xauthority:/root/.Xauthority:rw\wenbowen123/foundationposebash# 查看正在运行的容器dengwei@youdao:~$ dockerps-a CONTAINER ID IMAGE COMMAND CREATED STATUS PORTS NAMES 2b45e0ae068d wenbowen123/foundationpose"bash"5weeks ago Up5weeks foundationpose# 进入该容器dengwei@youdao:~$ dockerexec-it 2b45e0ae068dbash(my)root@2b45e0ae068d:/##进入容器内目录(my)root@2b45e0ae068d:/# cd /workspace/FoundationPose(my)root@2b45e0ae068d:/workspace/FoundationPose## 构建项目(首次运行需要)(my)root@2b45e0ae068d:/workspace/FoundationPose# bash build_all.sh# 运行 demo(my)root@2b45e0ae068d:/workspace/FoundationPose# python run_demo.py --debug 2#以后不小心退出了容器,只要没删除容器,则可以重启容器:dengwei@youdao:~$ docker restart foundationpose dengwei@youdao:~$ dockerexec-it foundationposebash(my)root@2b45e0ae068d:/# cd /workspace/FoundationPose(my)root@2b45e0ae068d:/workspace/FoundationPose# python run_demo.py --debug 2
3、制作数据集进行目标姿态检测(自备3D模型)

目标物体的3D模型需要依赖iPhone 12 以上并且需要是PRO版本的(有深度相机) 或者是iPad PRO M1以上的设备,用AR Code应用app进行扫描得到,仅扫描模型无需花钱。
参考博客:https://www.cnblogs.com/day1024/p/18948051
已制作好的一份数据所在目录为:

/home/dengwei/PoseDetect/FoundationPose/demo_data/data1

修改文件…/FoundationPose/run_demo.py指定为你自己的数据即可跑出实时检测姿态的结果。

4、Grounded-Segment-Anything 配置与运行

该模型的功能是安装文字提示对图片进行语义分割。
参考博客安装python虚拟环境:https://blog.csdn.net/Acecai01/article/details/148233545

dengwei@youdao:~$ pyenvinstall3.8.10 dengwei@youdao:~$ pyenv virtualenv3.8.10 SAM dengwei@youdao:~$ pyenv activate SAM(SAM)dengwei@youdao:~$cd~/PoseDetect/(SAM)dengwei@youdao:~/PoseDetect$gitclone https://github.com/IDEA-Research/Grounded-Segment-Anything.git(SAM)dengwei@youdao:~/PoseDetect$cdGrounded-Segment-Anything(SAM)dengwei@youdao:~/PoseDetect/Grounded-Segment-Anything$cdGroundingDINO(SAM)dengwei@youdao:~/PoseDetect/Grounded-Segment-Anything/GroundingDINO$ python setup.py build_ext --inplace

可能还需安装其他python模块,下载模型权重,请参考博客配置:
https://www.cnblogs.com/wmt0822/p/19005202
使用模型对图片进行分割:

# 第1步骤,打开梯子,连接外网# 第2步骤,(SAM)dengwei@youdao:~/PoseDetect/Grounded-Segment-Anything$ python grounded_sam_demo.py --config GroundingDINO/groundingdino/config/GroundingDINO_SwinT_OGC.py\--grounded_checkpoint groundingdino_swint_ogc.pth\--sam_checkpoint sam_vit_h_4b8939.pth\--input_image /home/dengwei/PoseDetect/FoundationPose/demo_data/data1/rgb/0000000.png\--output_dir"outputs"\--box_threshold0.3\--text_threshold0.25\--text_prompt"bolt with nut"

注意上述使用命令中需要修改成你自己的图片路径,以及目标名字。此外,如果你用多张图片需要分割,可以让AI参考代码grounded_sam_demo.py写一个处理某个目录内多张图片的代码。

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/7/24 4:53:52

通过微调通用视觉或时序大模型提升小样本预测能力,或利用生成模型(如GAN、扩散模型)进行高质量数据增强与情景模拟

随着观测技术、数值模拟与计算基础设施的迅猛发展,地球系统科学、生态学、环境科学等自然科学领域正迈入“大数据智能模型”驱动的新阶段。传统的统计建模方法虽具可解释性,却难以应对高维、非线性、多源异构的复杂自然系统;而以机器学习和深…

作者头像 李华
网站建设 2026/7/24 8:24:05

Rust嵌入式开发终极指南:用cross实现DMA驱动的零配置跨编译

Rust嵌入式开发终极指南:用cross实现DMA驱动的零配置跨编译 【免费下载链接】cross “Zero setup” cross compilation and “cross testing” of Rust crates 项目地址: https://gitcode.com/gh_mirrors/cr/cross 还在为嵌入式DMA驱动的交叉编译环境配置而烦…

作者头像 李华
网站建设 2026/7/22 17:23:27

Carnac:让你的键盘操作惊艳全场!3大核心功能深度解析

Carnac:让你的键盘操作惊艳全场!3大核心功能深度解析 【免费下载链接】carnac A utility to give some insight into how you use your keyboard 项目地址: https://gitcode.com/gh_mirrors/ca/carnac 还在为录屏演示时观众看不清你的键盘操作而烦…

作者头像 李华
网站建设 2026/7/25 22:04:12

5分钟搞定FastGPT上下文管理:让AI对话像真人一样连贯自然

5分钟搞定FastGPT上下文管理:让AI对话像真人一样连贯自然 【免费下载链接】FastGPT labring/FastGPT: FastGPT 是一个基于PyTorch实现的快速版GPT(Generative Pretrained Transformer)模型,可能是为了优化训练速度或资源占用而设计…

作者头像 李华
网站建设 2026/7/25 13:47:46

Java开发者转型AI应用开发工程师:零门槛入门+框架选型+项目实践

文章为Java开发者提供了转型AI应用开发工程师的完整路径,强调Java开发经验是加速器而非障碍。详细介绍了四阶段转型路线:学习AI基本概念和API调用;选择合适框架(Spring AI、LangChain4j或Spring AI Alibaba)&#xff1…

作者头像 李华
网站建设 2026/7/25 11:16:02

实战分享:如何用FunASR构建游戏语音交互系统

实战分享:如何用FunASR构建游戏语音交互系统 【免费下载链接】FunASR A Fundamental End-to-End Speech Recognition Toolkit and Open Source SOTA Pretrained Models, Supporting Speech Recognition, Voice Activity Detection, Text Post-processing etc. 项目…

作者头像 李华