Le modèle LFM2 350M s'exécute sur votre appareil. Environ 300 Mo sont téléchargés avec WebGPU, ou jusqu'à 515 Mo avec WASM/CPU, puis mis en cache ; vos prompts ne sont envoyés à aucun serveur.
Préparation de l'expérience…
512 tokens maximum.
Démonstrateur expérimental : vérifiez les réponses avant de les utiliser. Détails du modèle