使用教程

面向普通用户,不需要 AI 或剪辑基础。遇到报错、卡顿或结果异常,请先查阅 常见问题

说明:本页内容来自软件随附的《使用教程》,正文更新于 v1.1 界面; 之后版本的界面调整见 更新日志。 如果界面文字与本页描述略有出入,以软件内的说明与提示为准。

开始前的准备

  1. 左侧导航 = 四个页面:图片放大 / AI 抠图 / 视频处理 / 音频处理,各管各的,互不干扰。
  2. 页面左边一列是设置,右边是结果区。所有参数改完即时生效,先调好再点「开始处理」
  3. 「设置」里可选计算设备(自动 / 具体显卡 / CPU)。软件启动时会自动检测:有独立显卡且引擎兼容就自动启用; 不兼容的显卡会自动改走兼容路线,功能不受影响,只是速度有差异。

抠图模型安装

软件安装包不含 AI 抠图模型。模型单独打包,约 1.4 GB。未安装模型时,「AI 抠图」页会显示黄色提示。

方式一(推荐):安装软件时,在「选择附加任务」页勾选「下载并安装模型包(来自 GitHub)」,安装程序会自动下载并放好。

方式二(下载失败或已装完软件时):下载 models_v1.0.zip,其中含中文安装说明,解压到:

程序目录\engines\rembg\
    birefnet-lite.onnx
    birefnet.onnx
    isnet-general-use.onnx
    isnet-anime.onnx
    u2net.onnx
    u2netp.onnx

图片放大

你要做什么:把一张图变清晰 / 变大。流程:添加图片 → 选算法 → 选倍数 → 开始处理。

第 1 步:添加图片

第 2 步:选择算法

素材类型选哪个
动漫 / 插画 / 二次元动漫插画(waifu2x)
照片 / 实拍 / 人像真实照片(Real-ESRGAN)

算法选择: 动漫图使用 Real-ESRGAN 会发糊,照片使用 waifu2x 会偏“画”。可用单张图片各试一次,对比后再批量处理。

waifu2x 下面还有两个模型:

第 3 步:选倍数

第 4 步:降噪

补充:如果素材本身没有压缩噪点,强档降噪反而会把真实的细节磨掉,建议从“关 / 弱”开始试。

第 5 步:高级选项

默认无需调整。画面发灰可试「清晰」,画面发虚可试「去模糊」,线条有锯齿可试「边缘抗锯齿」。

建议每次只增加一项,确认效果后再叠加。

结果

AI 抠图

你要做什么:去掉背景,只留主体。流程:添加图片 → 选模型 → 微调 → 预览 → 保存到输出目录。

第 1 步:添加图片

在「输入」下选图,支持多张批量。

第 2 步:选模型

用途选哪个
第一次用,不知道该选啥BiRefNet 高精度(默认推荐)
背景复杂、画面里有多个主体BiRefNet 完整版
人像 / 产品,边缘要干净ISNet 精细边缘
动漫插画ISNet 动漫
背景简单、要速度快U²-Net 通用
要最快、批量很多U²-Net 轻量

AI 抠图固定使用 CPU 计算,以避免占满显卡导致整机卡顿,批量处理时耗时较长。

第 3 步:参数微调

第 4 步:查看效果

右侧预览区处理完就能直接看;按住「查看原图」可以对比前后。彩色预览 = 原图 × 蒙版,棋盘格 = 透明区域。

结果

保存到输出目录(默认与源图同目录,多张自动分子文件夹)。格式与图片放大共用设置,要透明背景记得选 PNG

视频处理:超分、补帧与去重

功能说明:视频超分用于提升清晰度,补帧用于提升流畅度,去重用于删除重复帧。流程:添加视频 → 勾选处理项 → 设置参数 → 开始。

注意:至少要勾选「超分」或「补帧」其中一项才能开始处理。只做去重时需同时勾选补帧,去重属于预处理步骤。

第 1 步:添加视频

拖入或点击列表添加,支持 MP4 / MKV / MOV / WebM 与多视频批量。每个视频可在右侧时间线上单独裁剪,也可单独设置帧率。

第 2 步:视频超分

素材引擎
老动画 / 低清动漫经典动漫(waifu2x,最快)
真人 / 实拍通用(Real-ESRGAN)

第 3 步:补帧

补帧会在原有帧之间生成中间帧,让动作更流畅。动漫 24fps 补到 60fps、电视 25/30fps 补到 60fps 都是常见用途。

第 4 步:去除重复帧

去重会删除静止与重复的画面,只保留真实内容帧,可让补帧更准确、文件更小。

注意:去重 + 补帧后的最终输出时长 = 源时长(尾帧保留),帧率 = 内容帧率 × 补帧倍率。

第 5 步:输出

兼容模式

勾选后会自动降低显存占用,避免显存不足或卡死,画质基本不变。没有独立显卡、显存较小或处理不稳定时勾选,其它场景无需开启。

可选后处理

别把两个「边缘增强」弄混: AI 抠图页的「边缘增强」处理的是蒙版边缘(去掉背景后主体轮廓的毛糙、白边、碎点), 视频页的这个处理的是画面本身的边缘对比(超分后线条、轮廓的清晰度)。两者各调各的,互不影响。

音频处理

功能说明:音频处理包含升采样率、增强、人声与伴奏分离以及降噪。流程:添加音频 → 勾选处理项 → 开始处理,支持批量。

AI 升采样率

勾「AI 升采样率(低采样率源 → 48kHz)」:电话录音、老磁带这类 8k / 16k / 22k / 32k 的低采样率音频,AI 会补出缺失的高频并提升到 48kHz,听得出来变清晰。 44.1k 以上的正常音乐本身已是全频带,软件会自动跳过,不会报错。

增强

对人声做优化处理,使咬字更清晰、层次更好。强度有关、柔和(推荐)、标准与强力四档。勾选后作用于最终输出,不会单独生成文件。

AI 分离:人声与伴奏

用神经网络把人声和伴奏拆开,可多选:

AI 分离优先使用显卡加速(DirectML);没有可用显卡时使用 CPU 计算,一首歌约需几分钟至十几分钟。

降噪

音色调整

预览与裁剪

输出格式选择

场景建议
图片要给别人看 / 上传JPG,质量 85~95
图片要去背景、要透明PNG
视频要在手机 / 电视 / 平台上放MP4 + H.264,码率自动
视频想同画质但文件更小MKV(或 MP4)+ H.265,注意老设备可能播不了
音频要在手机上听MP3(兼容性最好)
音频要再编辑 / 存档WAV 或 FLAC(无损)

输出目录默认与源文件同目录,批量处理会自动建子文件夹,原文件不会被覆盖。

效率建议

  1. 先用一小段样片试跑。截取 5~10 秒、几十帧,确认模型与倍率后再整段处理,可减少返工。
  2. 动漫片源先开去重再补帧。重复帧先去干净,补帧结果更准,文件也更小。
  3. 较旧的电脑从 1x 超分 / 2x 补帧起步。画面够用即可,倍率越高代价越大。
  4. 留意状态栏与日志。其中会写明当前使用显卡还是 CPU、是否降级以及预计剩余时间;疑似卡住时先查看日志。
  5. 处理重要素材前先备份原文件,并留意临时磁盘空间。

本页未覆盖的问题,请查阅 常见问题;各版本变更见 更新日志