通用技能媒体、音频与视频

scenelens

按场景提取视频帧、OCR 文本并合并长音频转录

Stars
3
Forks
0
License
MIT
更新于
更新于 2026年5月8日

正在检查仓库实时数据……

项目概览

SceneLens 把公开视频链接或本地视频整理成更适合 Claude 分析的输入:在镜头变化处抽帧,逐帧识别屏幕文字,并优先读取原生字幕;没有字幕时再调用 Groq 或 OpenAI Whisper,长音频会自动分块后合并时间戳。它最适合 10 分钟以内的视频,最多输出 100 帧,无法访问需要登录的私有平台。

仓库事实

主要语言
Python
许可证
MIT
仓库更新时间
2026年5月8日
默认分支
main

资源类型

通用技能

使用场景

媒体、音频与视频

运行平台

Claude Code、Codex 等

运行方式

本地运行

核心能力

语音转写

相关项目

查看更多同类项目