Outils développeurActualité

Hugging Face : préparer un démarrage de modèle hors ligne

Sur cette page
  1. L’actualité a évolué
  2. Figer l’entrée avant de remplir le cache
  3. Un essai en trois états
  4. Définir une réussite au-delà des fichiers

Le projet de vente évoqué en août a été suivi de l’accord de rachat annoncé par Nvidia le 3 septembre. La question technique demeure utile : l’application démarre-t-elle avec le modèle prévu quand le Hub est inaccessible ?

Essai hors ligne proposé : remplir un cache dédié, tester sans accès au Hub, puis vérifier l’échec explicite avec un cache vide. Aucun modèle exécuté pour ce schéma.
Essai hors ligne proposé : remplir un cache dédié, tester sans accès au Hub, puis vérifier l’échec explicite avec un cache vide. Aucun modèle exécuté pour ce schéma. Graphique : PeopleAreGeek. Source des données.
Agrandir l’image

L’actualité a évolué

L’annonce officielle de Nvidia confirme un accord d’environ 12,93 milliards de dollars. Notre article actualisé sur le rachat détaille les engagements de plateforme. Cette page conserve le sujet pratique de l’article initial : les téléchargements nécessaires au démarrage.

Une annonce de changement de propriétaire ne prouve pas une panne imminente. La préparation hors ligne est utile parce que réseau, disponibilité d’un dépôt et lancement de l’application restent des dépendances distinctes, quel que soit le propriétaire.

Figer l’entrée avant de remplir le cache

Le guide de téléchargement documente le paramètre revision, notamment avec un hash de commit complet. Une branche telle que main peut désigner des fichiers différents selon le jour. Conservez la révision résolue, pas seulement le nom du dépôt.

Inventoriez ce que l’application charge réellement : fragments de poids et leur index, fichiers du tokenizer, configuration et code local nécessaire. Un téléchargement limité aux JSON peut récupérer la configuration tout en laissant tous les poids absents. « Téléchargement réussi » ne décrit que les fichiers demandés.

Un essai en trois états

Utilisez un environnement jetable avec un cache dédié et le moteur prévu. Première étape : récupérer la révision nécessaire avec accès réseau. Deuxième étape : démarrer depuis ce cache rempli avec l’accès au Hub désactivé. Troisième étape : recommencer avec un cache de test vide et vérifier qu’une donnée manquante entraîne un échec explicite. Ce dernier état permet de détecter une réussite qui reposait sur un téléchargement silencieux.

Le réglage documenté HF_HUB_OFFLINE supprime les requêtes HTTP au Hub dans huggingface_hub et fait échouer un téléchargement absent du cache. Définissez-le avant le lancement du processus. Ce n’est pas un pare-feu système : d’autres bibliothèques ou appels d’inférence distante peuvent encore utiliser le réseau. Un essai totalement hors ligne exige un contrôle réseau couvrant l’ensemble du processus de test.

Définir une réussite au-delà des fichiers

Une fiche de validation originale peut consigner quatre résultats : révision résolue, présence des fichiers requis, chargement du modèle et traitement d’une entrée fixe avec la structure de sortie attendue. Les empreintes de fichiers vérifient leur identité, pas la capacité du moteur à exécuter le modèle.

Conservez les fichiers dans le respect de leurs permissions d’accès et de licence. Mettre en cache le client d’une API d’inférence ne rend pas son service local. Il s’agit d’un protocole proposé, pas de l’affirmation que PeopleAreGeek a téléchargé ou exécuté tous les modèles du Hub.

Revue du 8 septembre : sources primaires et évolutions vérifiées, explications et illustrations reprises.