项目管理Project
创建、打开、编辑、删除多个项目,每个项目对应一个素材目录。
v1.2.1 Windows 10 / 11 桌面应用 · 本地运行
用标签、自定义列和筛选来管理图片、视频与音频素材,无损拆分视频片段,并按需执行本地 AI 分析。不修改原始文件名,不依赖云服务。
Features
不移动、不重命名原始文件,所有标签与列数据记录在项目目录的 record.json 中,可随项目一起备份和迁移。
创建、打开、编辑、删除多个项目,每个项目对应一个素材目录。
自定义标签名称与颜色,右键快速标记,多选筛选,底部图例栏随时对照。
按需添加文本、单选、多选、日期等数据列,双击单元格直接编辑。
按标签多选(OR 逻辑)、文件名、类型、大小和自定义列组合筛选与排序。
基于 FFmpeg 流复制的无损拆分,支持按时间点批量导出片段。
鼠标悬停文件名即可预览图片或播放视频,文件名单元格同步显示播放进度。
基于 watchdog 自动感知目录内文件的新增、删除与重命名并同步列表。
内置简体中文与 English,界面即时切换,无需重启。
深色与浅色主题一键切换,长时间整理素材更省眼。
AI Analysis
针对视频、音频与图片(JPG / PNG / BMP / TIFF / WebP)。模型与推理全部在本机执行,不经过任何云接口。点击下方阶段可查看对应模块。
01 / 语音识别
输出逐句文本、情绪倾向与语音占比。
faster-whisper large-v302 / 目标检测
统计镜头数、镜头类型、人物数量与场景切换点。
Ultralytics YOLOv803 / 文字识别
读取画面中的品牌名、包装文字与字幕信息。
EasyOCR04 / 视觉描述
对画面内容给出自然语言描述,可按需启用。
Ollama llava:7b05 / 智能摘要
给出关键词、分类、情绪与剪辑建议,并计算高光评分与推荐片段。
Ollama qwen2.5:7b当前阶段:ASR 语音识别 · faster-whisper 20%
Download
安装包已内置运行环境,Windows 下双击安装即可,无需额外安装 Python。
https://mm.qzent.ai/releases/MediaManager_Setup_v1.2.1.exe
%APPDATA%\MediaManager\。
官网直连不理想时改用云盘镜像,同一安装包,免登录、无需客户端。
提取码54jv
扫码加入用户群,获取更新提醒与使用答疑。
Quick Start
核心管理功能不需要任何 AI 组件,安装后即可使用。
在欢迎页点击「新建项目」,选择存放素材的文件夹。
进入「项目设置」,定义标签名称与颜色,并按需要添加自定义列。
右键文件设置标签,双击单元格填写自定义列内容。
使用顶部筛选栏按标签多选过滤,或在「视频拆分」中按时间点导出片段。
选中文件后点击工具栏「AI 分析」,或右键单文件分析。音频自动锁定语音识别模式;图片使用目标检测、文字识别与视觉描述。
Requirements
Tech Stack
核心功能仅依赖本地组件,AI 相关组件按需安装并全部在本机运行。
FAQ
不会修改任何原始文件名或文件内容。标签、自定义列与备注写在项目目录下的 record.json 元数据文件中,随项目目录一起复制或备份即可迁移。
不需要。AI 分析是可选模块,安装包不含对应依赖与模型。安装后在软件内「AI 分析 → AI 环境配置」中按向导一键安装即可启用;不安装时其余管理功能完全可用。
日常管理功能完全离线。AI 分析在本机执行推理,模型下载需要联网,分析过程不上传素材内容。
可以,使用纯 CPU 模式运行,速度明显慢于 GPU。建议 8 GB 以上内存;有独显时通过 PyTorch + CUDA 加速。
这是早期版本将配置写入 Program Files 导致的权限问题,现版本已将配置改写到 %APPDATA%\MediaManager\。若仍遇到,请确认以当前用户身份安装而非系统全局限定目录。
可以改用蓝奏云备用链接下载同一安装包;若两条链接都不可用,请通过页面下方的用户群反馈。
MIT 非商业许可证,可自由使用与修改,商业用途需另行获得授权。