Skip to content

superbaseballman/Missav-Information-Extractor

Folders and files

NameName
Last commit message
Last commit date

Latest commit

 

History

13 Commits
 
 
 
 

Repository files navigation

成人影片信息提取器

简介

成人影片信息提取器是一个强大的Tampermonkey用户脚本,专门用于从成人影片网站(如missav.live)提取影片的元数据信息。该脚本支持智能识别、面板隐藏显示和移动端适配,能够自动提取包括番号、女优、发行商、系列、类型、发行日期等核心信息。

功能特点

  • 智能关键词匹配:自动识别页面中的关键词并提取对应信息
  • 双重提取模式:支持智能提取和CSS选择器提取两种模式
  • 响应式设计:自动适配桌面端和移动端设备
  • 一键导出:支持JSON格式导出和复制到剪贴板
  • 浮动面板:可隐藏/显示的控制面板,不干扰正常浏览
  • 视频原始地址提取:可获取视频原始地址

支持的提取字段

  • 番号
  • 标题
  • 女优
  • 男优
  • 类型
  • 系列
  • 发行商
  • 发行日期
  • 导演
  • 标签
  • 图片URL

安装方法

  1. 确保浏览器已安装Tampermonkey扩展
  2. 点击此链接下载脚本文件
  3. 在Tampermonkey中点击"添加新脚本"
  4. 将脚本内容复制到编辑器中并保存
  5. 访问支持的网站即可使用

使用方法

桌面端操作

  1. 访问支持的影片网站(如missav.live)
  2. 页面右上角会出现"📋 显示面板"浮动按钮
  3. 点击按钮显示提取控制面板
  4. 选择提取方式:
    • 智能提取:自动识别页面关键词并提取信息
    • CSS提取:使用预设的CSS选择器提取信息
  5. 点击"导出JSON"或"复制结果"保存数据

移动端操作

  1. 在支持油猴脚本的浏览器中打开网站
  2. 屏幕底部会出现"📋 显示面板"浮动按钮
  3. 点击按钮显示提取控制面板
  4. 操作方式与桌面端相同

配置说明

脚本支持自定义配置,您可以根据需要修改以下设置:

智能关键词配置

const CONFIG = {
    smartExtract: {
        keywordMapping: {
            '番号': '番号',
            '女优': '女优',
            '出演者': '女优',
            '发行商': '发行商',
            '系列': '系列',
            '类型': '类型',
            '标籤': '标签',
            '发行日期': '发行日期',
            '导演': '导演',
            '男优': '男优'
        },
        containerSelectors: ['.space-y-2', '.info-section', '.details-container'],
        excludeClasses: ['hidden', 'invisible']
    }
};

CSS选择器配置

traditional: {
    releaseDate: '',
    code: '',
    title: 'h1',
    actresses: '',
    actors: '',
    genres: '',
    series: '',
    studio: '',
    director: '',
    tags: '',
    image: '',
    videoPoster: {
        selector: 'video[playsinline]',
        attribute: 'data-poster'
    },
    links: 'a[href]'
}

提取方式说明

智能提取

  • 自动扫描页面中的关键词(如"番号"、"女优"等)
  • 识别关键词附近的文本内容作为对应字段值
  • 支持自动处理缺失字段的后备方案

CSS提取

  • 使用预设的CSS选择器直接提取元素内容
  • 适用于页面结构相对固定的网站
  • 提供更精确的提取控制

输出格式

提取结果包含以下字段:

{
  "番号": "影片番号",
  "标题": "影片标题",
  "女优": ["女优1", "女优2"],
  "类型": ["类型1", "类型2"],
  "发行商": "发行商",
  "系列": "系列",
  "发行日期": "发行日期",
  "导演": "导演",
  "男优": ["男优1", "男优2"],
  "标签": ["标签1", "标签2"],
  "图片URL": "图片地址",
  "原始URL": "当前页面URL"
}

注意事项

  1. 网站兼容性:脚本目前主要支持missav.live网站,如需支持其他网站请修改脚本中的@match规则
  2. 页面结构变化:如果网站更新导致提取失败,请检查页面结构并相应调整CSS选择器
  3. 隐私保护:提取的数据仅在本地处理,不会上传到任何服务器
  4. 移动端支持:部分浏览器可能对用户脚本支持有限,请确保使用兼容的浏览器

常见问题

Q: 如何修改提取的字段?

A: 可以修改CONFIG.smartExtract.keywordMapping中的关键词映射关系。

更新日志

  • v1.9: 新增智能提取功能,支持关键词匹配和后备提取机制
  • v1.8: 优化移动端适配,添加触摸反馈效果
  • v1.7: 改进CSS选择器配置,支持多种图片属性提取
  • v1.6: 增加浮动面板设计,优化用户体验

贡献

欢迎提交Issue和Pull Request来改进脚本功能。

许可证

此脚本仅供个人学习和研究使用,请遵守相关法律法规。

About

No description, website, or topics provided.

Resources

Stars

0 stars

Watchers

0 watching

Forks

Releases

No releases published

Packages

 
 
 

Contributors