项目概览
audio-to-action 将录音转写、清理并分为五种场景,再按场景生成摘要、按人拆分的任务、待确认问题和消息草稿;每条任务或草稿都标出时间戳依据与不确定项。它不会自动发送对外消息,身份未知时保留 SPEAKER 标记,且目前不提供真实说话人识别、超长音频自动切片或跨会议记忆;运行需要配置 ASR 服务端点,若服务要求认证则通过环境变量提供密钥。
仓库事实
- 主要语言
- Python
- 许可证
- MIT
- 仓库更新时间
- 2026年5月7日
- 默认分支
- main
资源类型
通用技能
使用场景
生产力与办公沟通与协作媒体、音频与视频
运行平台
Claude Code、Codex 等
核心能力
语音转写