news 2026/10/7 9:46:53

HivisionIDPhotos:本地离线生成 AI 证件照,5 分钟出第一张

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
HivisionIDPhotos:本地离线生成 AI 证件照,5 分钟出第一张

HivisionIDPhotos:本地离线生成 AI 证件照,5 分钟出第一张

【免费下载链接】HivisionIDPhotos⚡️HivisionIDPhotos: a lightweight and efficient AI ID photos tools. 一个轻量级的AI证件照制作算法。项目地址: https://gitcode.com/GitHub_Trending/hiv/HivisionIDPhotos

为什么有人宁可自己电脑跑 AI,也不把人脸照片传上云?HivisionIDPhotos 是一个本地离线的 AI 证件照工具:丢一张随手拍进去,拿回标准照、高清透明抠图和带裁剪线的排版照;核心推理只要 0.207 秒,照片全程不出机器。

它是什么,会交给你哪些产物

它是本地 Gradio 网页应用,外加一组可独立调用的 Python 推理接口。与在线证件照服务的差异:人脸检测、抠图、合成全部跑在你自己的机器上;对比纯本地抠图工具,它多出排版打印、美颜与社媒模板。上传一张照片,产出三样东西:

产物用途
标准证件照默认 300 DPI,可直接送印
高清 4 通道透明 PNG反复合成任意底色,无需二次抠图
六寸排版照一张相纸排 12 张,裁剪线已画好

时间账:从 clone 到第一张证件照

全程只有装依赖和拉权重两步需要联网,之后完全离线。

① 克隆项目、装依赖(Python ≥ 3.7,官方按 3.10 测试):

git clone https://gitcode.com/GitHub_Trending/hiv/HivisionIDPhotos cd HivisionIDPhotos pip install -r requirements.txt -r requirements-app.txt

拉下代码和两套依赖;此时还跑不起来,因为缺模型权重。

② 拉模型权重:

python scripts/download_model.py --models all

权重统一落到hivision/creator/weights目录。想省流量,只拉两个 24.7MB 的小模型(modnet_photographic_portrait_matting与hivision_modnet)也够日常用。

③ 启动:

python app.py

浏览器自动打开本地页面:左侧调参数,右侧是三个结果区。上传照片、选尺寸和底色即可出图;从上传到拿到三张图,默认参数下通常不到 1 分钟,其中 0.207 秒只是纯推理耗时(512×715 图,M1 Max 纯 CPU 实测)。

一张照片的三种用法

第一层:单张开图,把细节修掉

  • 换底色只要几秒:同一张透明 PNG 反复合成,红蓝白灰有预设,自定义 HEX 可直接输入,纯色、渐变都支持;
  • 尺寸随你定:除一寸、二寸等内置规格外,可输入任意像素宽高,毫米单位也认;
  • 送去打印:排版功能把 12 张照片排进一张相纸并画好裁剪线,支持六寸、五寸、A4、3R、4R 五种相纸;
  • 出片前轻修:美颜参数可调;社媒模板把人像放进预设透明区域;美式证件照背景也有。

第二层:批量与服务化

  • API 后端:python deploy_api.py启动 FastAPI 服务,图片文件或 base64 都能传,可附带美颜、dpi 等参数,适合批量处理;
  • Docker:docker pull linzeyi/hivision_idphotos后执行docker run -d -p 7860:7860 linzeyi/hivision_idphotos,访问 127.0.0.1:7860 即可,适合挂服务器或 NAS;
  • 命令行解耦:inference.py把流程拆成抠图、加底色、排版等可组合步骤,单步调用也行。

第三层:嵌入自有系统

cURL 与 Python 请求示例都在 docs/api_CN.md 里。社区还衍生出 ComfyUI 工作流、微信小程序、C++ 版本等形态,接入自家业务前可以参考这些现成实现。

适合还是劝退:装之前看数字

适合

  • 急着一寸照、又约不上照相馆的人;
  • 考试报名对背景色、尺寸有硬性要求,需要反复换色的人;
  • 想把本地推理嵌进自家系统、不依赖付费云端接口的开发者。

劝退

  • 想要"自动换正装"的:路线图上排着,尚未落地;
  • 内存不够 6.2GB 又想顶级精度的:birefnet-v1-lite 模型文件只有 224MB,实际占内存 6.2GB、单张 7 秒出头。

隐私与性能(均为实测值):所有推理在本地完成,照片不出机器,默认 MTCNN 人脸检测同为离线模型。MODNet + MTCNN 组合内存约 410MB;若你有一块 16GB 左右显存的 NVIDIA GPU,birefnet-v1-lite 可 GPU 加速。

下次急要证件照,把仓库 clone 下来装好依赖,5 分钟出第一张;最新功能以仓库 README 为准。

【免费下载链接】HivisionIDPhotos⚡️HivisionIDPhotos: a lightweight and efficient AI ID photos tools. 一个轻量级的AI证件照制作算法。项目地址: https://gitcode.com/GitHub_Trending/hiv/HivisionIDPhotos

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/10/7 9:46:49

Flight Mixin API 详解:组件式 JavaScript 框架中的混合复用机制

前端Web框架 【免费下载链接】flight A component-based, event-driven JavaScript framework from Twitter 项目地址: https://gitcode.com/gh_mirrors/fl/flight 点击查看 免费下载 本篇技术指南围绕 Flight(来自 Twitter 的 component-based、event-…

作者头像 李华
网站建设 2026/10/7 9:46:32

YOLO目标检测数据集实战:罐头与瓶子双格式标注与训练指南

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

作者头像 李华
网站建设 2026/10/7 9:45:39

RGB-Mini LED三色直出,1.2亿色彩背后的画质革命

RGB-Mini LED这个名词,我盯了差不多两年。从最初实验室里的样机,到展会上的工程机,再到今天海信把UX2026款正式端到台前,这条路走得比很多人想象中更久。这次发布最抓眼球的是两件事:一个是“7大全球首创”&#xff0c…

作者头像 李华
网站建设 2026/10/7 9:43:57

Slidev:用 Markdown 快速做出可交互的开发者幻灯片

Slidev:用 Markdown 快速做出可交互的开发者幻灯片 【免费下载链接】slidev Presentation Slides for Developers 项目地址: https://gitcode.com/GitHub_Trending/sl/slidev 技术分享前最常见的两个麻烦:代码贴在 PPT 里又丑又难改,演讲时既没有备注也没有计时,全靠硬撑…

作者头像 李华