OpenAI/GPTActif

Whisper Large V3

Whisper is a state-of-the-art model for automatic speech recognition (ASR) and speech translation, proposed in the paper Robust Speech Recognition via Large-Scale Weak Supervision by Alec Radford et al. from OpenAI. Trained on >5M hours of labeled data, Whisper demonstrates a strong ability to generalise to many datasets and domains in a zero-shot setting.

Contexte
0
Sortie maximale
Inconnu
Entrée
7,5 $US
Sortie
0,00 $US
DECISION SUMMARY

Cas d’usage recommandés

Points forts dans ces données

  • 0-token context window
  • audio input
  • 12 supported API parameters listed

Limites et réserves

  • Provider behavior and pricing can change; verify the linked sources before production use.
CAPABILITIES

Capacité

Faits propres au modèle

Modèle
Raisonnement
Inconnu
Poids ouverts
Pris en charge

Faits de l’endpoint fournisseur

Endpoint fournisseur
Appels d’outils
Non pris en charge
Sortie structurée
Pris en charge
Streaming
Inconnu
Cache de prompt
Inconnu
Traitement par lots
Inconnu
Ajustement fin
Inconnu
PROVIDER PRICING

Whisper Large V3 Tarifs du fournisseur

Endpoint fournisseur: openai/whisper-large-v3

Entrée
7,5 $US
par million de tokens
Sortie
0,00 $US
par million de tokens
Entrée en cache
Inconnu
par million de tokens
Sortie image
Inconnu
par million de tokens
SOURCE RECORDS

Sources et vérification

Hugging Face model card

Champs: tags, gated, license, summary, languages, library name, pipeline tag

OpenRouter Models API

Champs: identity, description, modalities, context window, maximum output, pricing, supported parameters

MODEL FAQ

Questions fréquentes

Les réponses utilisent les mêmes données sourcées sur le modèle et les fournisseurs que celles affichées ci-dessus.

Whisper Large V3 est un modèle d’IA de OpenAI, appartenant à la famille GPT. Sa fenêtre de contexte répertoriée est de 0.

Les spécifications et tarifs peuvent varier selon le fournisseur et évoluer. Vérifiez les sources et dates de validation avant toute utilisation en production.