songsee
Audio spectrograms/features (mel, chroma, MFCC) via CLI.
DeepseekModel
官方收录技能
质量 优秀 · 90
v1.0.0
获取
https://deepseekmodel.com/api/download.php?id=nousresearch-hermes-agent-skills-media-songsee-skill-md&format=skill
下载 .skill
标准格式,含 system_prompt 与 model_config,导入任意 Agent 框架即可使用
.skill 文件中 system_prompt 字段的实际内容。
name songsee description Audio spectrograms/features (mel, chroma, MFCC) via CLI. version 1.0.0 author community license MIT platforms ["linux","macos","windows"] metadata {"hermes":{"tags":["Audio","Visualization","Spectrogram","Music","Analysis"],"homepage":"https://github.com/steipete/songsee"}} prerequisites {"commands":["songsee"]} songsee Generate spectrograms and multi-panel audio feature visualizations from audio files. Prerequisites Requires Go : go install github.com/steipete/songsee/cmd/songsee@latest Optional: ffmpeg for formats beyond WAV/MP3. Quick Start # Basic spectrogram songsee track.mp3 # Save to specific file songsee track.mp3 -o spectrogram.png # Multi-panel visualization grid songsee track.mp3 --viz spectrogram,mel,chroma,hpss,selfsim,loudness,tempogram,mfcc,flux # Time slice (start at 12.5s, 8s duration) songsee track.mp3 --start 12.5 --duration 8 -o slice.jpg # From stdin cat track.mp3 | songsee - --format png -o out.png Visualization Types Use --viz with comma-separated values: Type Description spectrogram Standard frequency spectrogram mel Mel-scaled spectrogram chroma Pitch class distribution hpss Harmonic/percussive separation selfsim Self-similarity matrix loudness Loudness over time tempogram Tempo estimation mfcc Mel-frequency cepstral coefficients flux Spectral flux (onset detection) Multiple --viz types render as a grid in a single image. Common Flags Flag Description --viz Visualization types (comma-separated) --style Color palette: classic , magma , inferno , viridis , gray --width / --height Output image dimensions --window / --hop FFT window and hop size --min-freq / --max-freq Frequency range filter --start / --duration Time slice of the audio --format Output format: jpg or png -o Output file path Notes WAV and MP3 are decoded natively; other formats require ffmpeg Output images can be inspected with vision_analyze for automated audio analysis Useful for comparing audio outputs, debugging synthesis, or documenting audio processing pipelines
Agent 识别该技能的关键词,点击任意一个即可复制。
该技能未提供触发词。
下载的 .skill 包内含以下字段。
| 字段 | 说明 |
|---|---|
| format | 格式标识(skill/v1) |
| skill_id | 技能唯一 ID |
| name | 技能名称 |
| version | 版本号 |
| description | 技能描述 |
| category | 所属分类(数组) |
| trigger_words | 触发词列表 |
| tags | 标签列表 |
| source | 来源标识 |
| source_url | 来源链接(本页地址) |
| exported_at | 导出时间(每次下载生成) |
| system_prompt | 系统提示词正文 |
| model_config | 模型参数:provider / model / temperature / max_tokens / top_p |
| examples | 示例 |
| install_guide | 各平台导入说明(Coze / Dify / Claude / 自定义框架) |