Skip to content

Latest commit

 

History

History
269 lines (198 loc) · 13.3 KB

File metadata and controls

269 lines (198 loc) · 13.3 KB

English | 中文 | 日本語 | 한국어 | Español | Français | Deutsch | Português | Русский | العربية | हिन्दी | Italiano | Türkçe | Tiếng Việt | ภาษาไทย | Bahasa Indonesia | Polski | Nederlands

Logo OpenTypeless

OpenTypeless

Input vocale IA open source per desktop. Parla in modo naturale, ottieni testo raffinato in qualsiasi applicazione.

Che tu stia scrivendo email, codice, chattando o prendendo appunti — basta premere un tasto,
esprimi i tuoi pensieri, e OpenTypeless trascrive e raffina le tue parole con l'IA,
poi le digita direttamente nell'applicazione che stai usando.

CI Release Licenza Stelle Discord

Input vocale OpenTypeless adattato a Gmail, Slack, Google Docs, Cursor, Zendesk e LinkedIn

Demo OpenTypeless

Funzionalità principali

  • Scrittura consapevole dell’app rileva localmente l’applicazione attiva e adatta struttura e tono per e-mail, chat, documenti, sistemi di gestione delle issue, strumenti di sviluppo e altro ancora.
  • Instradamento dell’intento vocale distingue dettatura, modifica del testo selezionato, traduzione, Ask Anything e azioni vocali supportate in inglese, cinese semplificato e cinese tradizionale.
  • Più scorciatoie per flusso di lavoro consentono di aggiungere e riordinare più combinazioni per Dettatura, Ask Anything e Traduzione.
  • Destinazioni di traduzione intercambiabili permettono di passare rapidamente tra le lingue utilizzate senza fissare un’unica lingua di output.
  • Un dizionario locale più completo aggiunge regole di correzione e importazione/esportazione del dizionario.
  • Associazioni di stile per app consentono di sostituire la categoria integrata quando un’applicazione richiede uno stile di scrittura diverso.

Il rilevamento delle app, le associazioni, il dizionario e le regole di correzione vengono salvati localmente. La rifinitura consapevole dell’app invia al percorso LLM configurato solo la categoria interna dell’app e metadati di stile approvati; i titoli grezzi delle finestre e il contenuto dei documenti non vengono inviati come contesto né salvati nella cronologia.

Rifinitura IA consapevole dell’app Dizionario locale e correzioni
Rifinitura IA consapevole dell’app in OpenTypeless v1.1.49 Dizionario locale e correzioni in OpenTypeless v1.1.49
Altri screenshot

Finestra principale OpenTypeless

Impostazioni Cronologia

Perché OpenTypeless?

OpenTypeless Dettatura macOS Digitazione vocale Windows Whisper Desktop
Raffinamento testo con IA ✅ Multipli LLM
Scelta provider STT ✅ 6+ provider ❌ Solo Apple ❌ Solo Microsoft ❌ Solo Whisper
Funziona in qualsiasi app ❌ Copia-incolla
Modalità traduzione
Open source ✅ MIT
Multipiattaforma ✅ Win/Mac/Linux ❌ Solo Mac ❌ Solo Windows
Dizionario personalizzato
Self-hosting ✅ BYOK

Funzionalità

  • 🎙️ Tasto rapido globale — tieni premuto o attiva/disattiva
  • 💊 Widget capsula flottante, sempre in primo piano
  • 🗣️ 6+ provider STT: Deepgram, AssemblyAI, Whisper, Groq, GLM-ASR, SiliconFlow
  • 🤖 Raffinamento testo tramite più LLM: OpenAI, DeepSeek, Claude, Gemini, Ollama e altri
  • ⚡ Output in streaming — il testo appare man mano che il LLM lo genera
  • ⌨️ Simulazione tastiera o output tramite appunti
  • 📝 Seleziona il testo prima di registrare per dare contesto al LLM
  • 🌐 Modalità traduzione: parla in una lingua, ottieni l'output in un'altra (20+ lingue)
  • 📖 Dizionario personalizzato per termini specifici del dominio
  • 🔍 Rilevamento per applicazione per adattare la formattazione
  • 📜 Cronologia locale con ricerca full-text
  • 🌗 Tema scuro / chiaro / sistema
  • 🚀 Avvio automatico all'accesso

Tip

Configurazione consigliata per la migliore esperienza

Provider Modello
🗣️ STT Groq whisper-large-v3-turbo
🤖 Raffinamento IA Google gemini-2.5-flash

Questa combinazione offre trascrizione veloce e accurata con raffinamento del testo di alta qualità — ed entrambi offrono generosi livelli gratuiti.

Download

Scarica l'ultima versione per la tua piattaforma:

Scarica dalle Releases

Piattaforma File
Windows Installer .msi
macOS (Apple Silicon) .dmg
macOS (Intel) .dmg
Linux .AppImage / .deb

Prerequisiti

Per iniziare

# Installa le dipendenze
npm install

# Esegui in modalità sviluppo
npm run tauri dev

# Compila per la produzione
npm run tauri build

L'applicazione compilata si troverà in src-tauri/target/release/bundle/.

Configurazione

Tutte le impostazioni sono accessibili dal pannello Impostazioni dell'app:

  • Riconoscimento vocale — scegli il provider STT e inserisci la tua chiave API
  • Raffinamento IA — scegli il provider LLM, modello e chiave API
  • Generale — tasto rapido, modalità output, tema, avvio automatico
  • Dizionario — aggiungi termini personalizzati per una migliore precisione di trascrizione
  • Scene — modelli di prompt per diversi casi d'uso

Le chiavi API sono memorizzate localmente tramite tauri-plugin-store. Nessuna chiave viene inviata ai server OpenTypeless — tutte le richieste STT/LLM vanno direttamente al provider configurato.

Opzione Cloud (Pro)

OpenTypeless offre anche un abbonamento Pro opzionale che fornisce quota gestita di STT e LLM per non dover usare le proprie chiavi API. È completamente opzionale — l'app è pienamente funzionale con le proprie chiavi.

Scopri di più su Pro

BYOK (Bring Your Own Key) vs Cloud

Modalità BYOK Modalità Cloud (Pro)
STT La tua chiave API (Deepgram, AssemblyAI, ecc.) Quota gestita (10h/mese)
LLM La tua chiave API (OpenAI, DeepSeek, ecc.) Quota gestita (~5M token/mese)
Dipendenza cloud Nessuna — tutte le richieste vanno direttamente al tuo provider Richiede connessione a www.opentypeless.com
Costo Paga direttamente il tuo provider Abbonamento $4,99/mese

Tutte le funzionalità principali — registrazione, trascrizione, raffinamento IA, output tastiera/appunti, dizionario, cronologia — funzionano completamente offline in modalità BYOK.

Self-Hosting / Senza Cloud

Per eseguire OpenTypeless senza dipendenza cloud:

  1. Scegli un provider STT e LLM non Cloud nelle Impostazioni
  2. Inserisci le tue chiavi API
  3. Fatto — nessun account o connessione a www.opentypeless.com necessaria

Per reindirizzare le funzionalità cloud opzionali al tuo backend, imposta queste variabili d'ambiente prima della compilazione:

Variabile Predefinito Descrizione
VITE_API_BASE_URL https://www.opentypeless.com URL base API cloud frontend
API_BASE_URL https://www.opentypeless.com URL base API cloud backend Rust
# Esempio: compilare con un backend personalizzato
VITE_API_BASE_URL=https://my-server.example.com API_BASE_URL=https://my-server.example.com npm run tauri build

Architettura

Pipeline del flusso dati:

Microfono → Cattura audio → Provider STT → Trascrizione grezza → Raffinamento LLM → Output tastiera/appunti
src/                  # Frontend React (TypeScript)
├── components/       # Componenti UI (Impostazioni, Cronologia, Capsula, ecc.)
├── hooks/            # Hook React (registrazione, tema, eventi Tauri)
├── lib/              # Utility (client API, router, costanti)
└── stores/           # Gestione stato Zustand

src-tauri/src/        # Backend Rust
├── audio/            # Cattura audio via cpal
├── stt/              # Provider STT (Deepgram, AssemblyAI, compatibile Whisper, Cloud)
├── llm/              # Provider LLM (compatibile OpenAI, Cloud)
├── output/           # Output testo (simulazione tastiera, incolla da appunti)
├── storage/          # Configurazione (tauri-plugin-store) + cronologia/dizionario (SQLite)
├── app_detector/     # Rilevamento applicazione attiva per contesto
├── pipeline.rs       # Orchestrazione Registrazione → STT → LLM → Output
└── lib.rs            # Setup app Tauri, comandi, gestione tasti rapidi

Roadmap

  • Sistema di plugin per integrazioni STT/LLM personalizzate
  • Miglioramento della precisione STT multilingue e supporto dialetti
  • Comandi vocali
  • Combinazioni di tasti personalizzabili
  • Esperienza di onboarding migliorata
  • App mobile companion

FAQ

Il mio audio viene inviato al cloud? In modalità BYOK, l'audio va direttamente al provider STT scelto (es. Groq, Deepgram). Niente passa attraverso i server OpenTypeless. In modalità Cloud (Pro), l'audio viene inviato al nostro proxy gestito per la trascrizione.

Posso usarlo offline? Con un provider STT locale (Whisper tramite Ollama) e un LLM locale (Ollama), l'app funziona completamente offline. Nessuna connessione internet necessaria.

Quali lingue sono supportate? STT supporta 99+ lingue a seconda del provider. Il raffinamento IA e la traduzione supportano 20+ lingue di destinazione.

L'app è gratuita? Sì. L'app è pienamente funzionale con le proprie chiavi API (BYOK). L'abbonamento Cloud Pro ($4,99/mese) è opzionale.

Comunità

Contribuire

I contributi sono benvenuti! Consulta CONTRIBUTING.md per il setup di sviluppo e le linee guida.

Cerchi da dove iniziare? Controlla le issue con l'etichetta good first issue.

Star History

Grafico Star History

Sviluppato con Claude Code in un giorno

L'intero progetto è stato costruito in un solo giorno usando Claude Code — dalla progettazione dell'architettura all'implementazione completa, inclusi backend Tauri, frontend React, pipeline CI/CD e questo README.

Licenza

MIT