mirror of
https://github.com/R0m1k3/EveFlow.git
synced 2026-10-11 17:29:03 +02:00
- electron/voice: model catalog (Whisper base/small/turbo, SenseVoice, Kokoro v1.0, Piper fr), streaming tar.bz2 downloader with progress, sherpa-onnx worker running in an Electron utilityProcess (transcribe / synthesize / status / unload), IPC + bridge. - Renderer: 'local' providers for STT and TTS, Settings → Modèles locaux (download, progress, delete, activate), speaker selection, hands-free wake word with a tolerant matcher (accents, punctuation, edit distance) and attention window after a bare wake word. - Packaging: native addon and worker unpacked from the asar; release 2.1.0. Validated on Linux: Kokoro (fr) → Whisper base round trip, Piper (fr) → Whisper round trip. Co-Authored-By: Claude Fable 5.1 <noreply@anthropic.com> Claude-Session: https://claude.ai/code/session_017Wn5VX9HNbJ7N54hR24u9Y
91 lines
2.0 KiB
TypeScript
91 lines
2.0 KiB
TypeScript
/** Local voice engine contract (sherpa-onnx in a utility process). Shared by main and renderer. */
|
|
|
|
export type VoiceModelKind = 'stt' | 'tts';
|
|
export type VoiceEngineKind = 'whisper' | 'sense-voice' | 'nemo-transducer' | 'kokoro' | 'piper';
|
|
|
|
export interface VoiceSpeaker {
|
|
id: number;
|
|
name: string;
|
|
lang: string;
|
|
}
|
|
|
|
export interface VoiceModelSpec {
|
|
id: string;
|
|
kind: VoiceModelKind;
|
|
engine: VoiceEngineKind;
|
|
name: string;
|
|
description: string;
|
|
languages: string[];
|
|
sizeMb: number;
|
|
url: string;
|
|
/** Folder created by the archive (files are referenced relative to it). */
|
|
dir: string;
|
|
/** Files that must exist once installed. */
|
|
files: string[];
|
|
speakers?: VoiceSpeaker[];
|
|
sampleRate?: number;
|
|
recommended?: boolean;
|
|
}
|
|
|
|
export interface VoiceModelStatus extends VoiceModelSpec {
|
|
installed: boolean;
|
|
downloading: boolean;
|
|
installedBytes: number;
|
|
}
|
|
|
|
export interface VoiceDownloadProgress {
|
|
id: string;
|
|
phase: 'download' | 'extract' | 'done' | 'error' | 'cancelled';
|
|
received: number;
|
|
total: number;
|
|
percent: number;
|
|
message?: string;
|
|
}
|
|
|
|
export interface TranscribeRequest {
|
|
modelId: string;
|
|
wav: Uint8Array;
|
|
language: string; // 'fr', 'en', 'auto'
|
|
}
|
|
|
|
export interface TranscribeResult {
|
|
text: string;
|
|
language?: string;
|
|
durationMs: number;
|
|
audioSec: number;
|
|
}
|
|
|
|
export interface SynthesizeRequest {
|
|
modelId: string;
|
|
text: string;
|
|
speaker: number;
|
|
speed: number;
|
|
}
|
|
|
|
export interface SynthesizeResult {
|
|
wav: Uint8Array;
|
|
sampleRate: number;
|
|
durationMs: number;
|
|
audioSec: number;
|
|
}
|
|
|
|
export interface VoiceEngineStatus {
|
|
available: boolean;
|
|
error?: string;
|
|
version?: string;
|
|
loaded: string[];
|
|
modelsDir: string;
|
|
}
|
|
|
|
export const VOICE_IPC = {
|
|
status: 'voice:status',
|
|
modelsList: 'voice:models:list',
|
|
modelsDownload: 'voice:models:download',
|
|
modelsCancel: 'voice:models:cancel',
|
|
modelsRemove: 'voice:models:remove',
|
|
modelsProgress: 'voice:models:progress',
|
|
transcribe: 'voice:transcribe',
|
|
synthesize: 'voice:synthesize',
|
|
unload: 'voice:unload'
|
|
} as const;
|