跳到主要内容
SHENICEST:
← 返回项目展厅

FEATURED PROJECT / EVENT 04

知音——恰到好处的音乐注脚

听懂每一秒,爱上每一曲

PROJECT ID#0485
TRACK软件
TEAM知音
SUPPORT THIS PROJECT
知音——恰到好处的音乐注脚软件
01

项目介绍

知音项目说明 ▎ 音乐界的「字幕组」——对每一个设计进行恰到好处的注脚。 一、说明问题 背景:普通人听歌只能凭感觉说「好听」,却说不出「为什么好听」。一首歌里真正打动人的瞬间——副歌的和声推进、某句歌词的呼应 、一件乐器的突然进入、混音里的空间感——这些「制作巧思」对普通听众是隐形的;而音乐创作者想拆解优秀作品的技法,又缺乏逐句、逐时刻的参考。 核心痛点: 1. 听众:缺少一个「实时、贴脸」的工具,在听歌当下就能看懂每一段到底好在哪。 2. 创作者:缺少一个能对着真实音频、逐时刻给出专业拆解的助手。 3. 门槛:音乐术语(混响、侧链压缩、分解和弦…)对圈外人晦涩难懂,没人当场解释。 4.行业: 用户粘性下降:腾讯音乐(QQ音乐/酷狗音乐)2025年月活用户流失约**2800万**,核心原因是平台同质化严重、体验单一,用户“听歌”之外没有更多留下来的理由。 竞争加剧:抖音旗下汽水音乐以“短视频式音乐发现”模式快速崛起,月活同比增长78%,对传统流媒体构成直接冲击。 AI焦虑:AI音乐生成技术正在冲击传统版权变现模式。各大平台尚未找到“AI+音乐”的正确姿势,更多是在防御而非进攻。 我的答案:给每一首歌配上「恰到好处的注脚」,像字幕一样跟着播放进度实时弹出。 二、方案 产品形态:一个常驻屏幕右下角的透明悬浮球,播放音乐时按时间轴弹出「注脚卡片」,从四个维度解析当前时刻——唱(演唱/人声) 、词(歌词/词作)、曲(旋律/作曲)、编(编曲/配器)。 技术方案: 1. 双角色 · 双引擎 - 听众模式:导入歌单截图 → 识别歌曲 → DeepSeek 批量生成「大白话」剧本(下沉通俗,无门槛看懂)。 - 创作者模式:上传音频/视频 → Gemini 音频模型现场「听」,生成「专业术语」剧本(高密度制作技法)。 2. 实时定位:常驻 PowerShell 轮询系统 SMTC(媒体会话)获取播放进度,窗口标题兜底;悬浮球按进度精确匹配当前注脚点。 3. 桌面端:Electron 主进程 + Next.js 渲染层,主窗口(湖蓝舞台两栏布局)+ 透明置顶悬浮球窗口,双窗口主题色实时同步。 4. 术语可点击:剧本里的音乐术语自动高亮,点击跳转搜索引擎并记录历史。 5. 本地缓存:生成的剧本落盘,同一首歌只生成一次,离线可回看。 我们做的是 **“创作者意图的翻译器”**——把创作者在唱、词、曲、编四个维度上投入的匠心,翻译成听众能听懂、能共鸣的日常语言。 技术路径 ① 用户上传歌单截图 | 网页前端(Streamlit) ② OCR识别截图中歌曲名 | PaddleOCR / EasyOCR ③ 将歌名列表传入大模型 | GPT / Claude API | ④ AI按四维度生成审美解析 | 结构化Prompt工程 | ⑤ 前端分栏展示解析结果 | 自定义CSS + 卡片式UI | 三、现场完成内容 1. ✅ 完整桌面应用:Electron 主进程 + preload IPC 桥 + 渲染层。 2. ✅ 主窗口:听众/创作者身份切换、歌单截图导入识别、批量预生成、上传音频现场解析、缓存曲库、点歌看解析、配色切换。 3. ✅ 悬浮球:透明置顶、点击穿透、可拖动、按进度实时弹出注脚卡片(时间戳 + core + 唱/词/曲/编)。 4. ✅ 外部播放器(网易云等)进度实时检测 + 注脚同步。 5. ✅ AI 双引擎:DeepSeek 文本剧本(听众)+ Gemini 音频解析(创作者),均落盘缓存。 6. ✅ 术语搜索 + 历史记录、主题色双窗口同步。 7. ✅ 桌面快捷方式一键启动。 四、使用方式 1. 启动:双击桌面「知音」快捷方式(或 知音.bat)。 2. 选身份:主窗口左上角切换「听众」/「创作者」。 3. 听众:点「+」导入歌单截图(或直接拖入)→ 自动识别歌曲 → 批量预生成 → 打开网易云等播放音乐 → 悬浮球自动弹注脚。 4. 创作者:上传音频/视频 → AI 现场听并生成解析。 5. 交互:点悬浮球弹出卡片,点「唱 / 词 / 曲 / 编」看各维度详解;点术语跳转搜索;右上角调色板换主题色。

02

团队

知音