Sistema de traduccion multilingue SST->NMT->TTS para lenguas low-resource. App React+Capacitor + modelos ByT5/NLLB200.
# π Global Speak
> Sistema de traducciΓ³n multilingΓΌe **SST β NMT β TTS**
> para lenguas con pocos recursos (*low-resource languages*)
| | |
|---|---|
| **Piloto** | EspaΓ±ol β Wolof (migrantes senegaleses) |
| **App** | React 18 + TypeScript + Capacitor (Android/iOS/Web) |
| **Modelos** | ByT5-large fine-tuned, NLLB-200 distilled 600M |
| **SST** | Whisper Large V3 |
| **TTS** | MMS-TTS (1100+ idiomas) |
---
## Pipeline
```
π€ Audio (voz) βββ Whisper βββ texto fuente βββ NMT (ByT5 / NLLB-200) βββ texto traducido βββ MMS-TTS βββ π Audio sintetizado
```
---
## Estado del Proyecto
π **Ver STATUS.md β** β trazabilidad completa de lo completado, en progreso y pendiente.
---
## Quick Start
```bash
# Clonar
git clone git@github.com:qidia-io/global-speak.git
cd global-speak
# App frontend
cd app
npm install
cp .env.example .env # Poner HF_TOKEN=
npm run dev #
localhost
# Compilar para Android
npx cap add android
npx cap sync
npx cap run android
```
---
## Estructura
```
global-speak/
βββ app/ # Frontend React + Capacitor
β βββ src/
β β βββ screens/ # Home, Voice, Text, Settings
β β βββ services/ # inferenceClient, audio, storage
β β βββ components/ # UI (Layout, RecordButton, LanguageSelector...)
β β βββ config/ # languages.ts
β βββ ...
βββ notebooks/ # Jupyter notebooks (NMT, SST, TTS)
βββ docs/ # DocumentaciΓ³n completa
βββ data/ # Datos + scripts ETL
βββ db/ # SQL schema
βββ agents/ # Perfiles de agentes Hermes
```
---
## Modelos
| Modelo | Uso | TamaΓ±o |
|---|---|---|
| `sainzpaa/SPANISH-WOLOF-BYT5` | NMT EspaΓ±ol β Wolof (custom fine-tune) | ~1.2 GB |
| `facebook/nllb-200-distilled-600M` | NMT 200 lenguas (fallback) | ~2.4 GB |
| `openai/whisper-large-v3` | Speech-to-Text | ~3 GB |
| `facebook/mms-tts` | Text-to-Speech (1100+ idiomas) | ~1 GB |
## Equipo de Agentes
| Agente | Rol | Especialidad |
|---|---|---| β¦