# Speaker ID + Diarization FT: pyannote.audio + WavLM — Çoklu Konuşmacı Ayrımı

> Source: https://sukruyusufkaya.com/learn/fine-tuning-cookbook/ftc-speaker-id-diarization-pyannote
> Updated: 2026-08-14T02:20:14.480Z
> Category: Fine-Tuning Cookbook (Model-by-Model)
> Module: Part VII — Speech & Audio Fine-Tuning
**TLDR:** Toplantı/çağrı merkezi transkripti: 'kim konuşuyor + ne diyor'. pyannote.audio (HF), WavLM speaker embedding, diarization pipeline (VAD → embedding → clustering). Çağrı merkezi case: müşteri vs operatör ayrımı, RTX 4090 + 100 saat TR çağrı dataset üzerinde FT.

