0
Aller au contenu

Le SLM

Le SLM, ou petit modèle linguistique, est un modèle plus compact d’intelligence artificielle destiné à des tâches bien définies, les exigences inférieures et souvent aussi la localisation de l’installation.

Ce qu'est le SLM

SLM signifie modèle de langue petit, c'est-à-dire modèle de langue petit. Il a moins de paramètres et moins de besoins en calcul que les modèles cloud étendus. Il peut fonctionner sur un serveur, un ordinateur ou un appareil mobile approprié et accomplir une tâche clairement défini.

Le mot petit ne signifie pas automatiquement faible, mais un compromis étroit entre capacité et efficacité.

Différence par rapport au grand modèle

Un grand modèle linguistique offre généralement une connaissance plus large et une plus grande flexibilité dans le travail de tâches complexes. Les SLM peuvent être plus rapides, moins chers et plus prévisibles dans un processus particulier. Le choix dépend du langage, de la longueur du contexte, de la précision, du matériel et du risque d'erreur.

Travail local et vie privée

Un modèle lancé sur son propre appareil peut limiter l'envoi de données hors organisation et fonctionner même avec une mauvaise connexion. Cependant, la sécurité n'est pas garantie par l'exploitation locale elle-même. Il faut contrôler l'accès, le stockage de l'historique, les mises à jour, le cryptage et le type de données que le modèle peut traiter.

Spécialisation et processus d'entreprise

SLM est adapté à la classification des messages, à la proposition de réponses, à l'extraction des données, au format de contrôle ou à l'assistance sur une base de connaissances limitée. Il ne peut pas diagnostiquer une clinique sans surveillance professionnelle et il ne peut pas modifier un prix ou une commande sans une règle vérifiée dans le cas de l'e-Commerce.

La qualité, les mesures et la combinaison des modèles

Le rôle est de fournir un ensemble de tests, un format attendu, une limite de sécurité et une procédure de remplacement sûre. Les cas simples peuvent être résolus par SLM et difficiles à transmettre à un modèle ou à une personne plus grande. On observe la précision, la latence, le prix, l'erreur et l'impact sur le processus réel.

Accès à l'accès

On choisit le modèle en fonction de la valeur et de la sensibilité du rôle, pas du nom de la mode. Dans un agent de marque premium, le SLM peut rapidement classer l'intention, tandis que la recommandation complexe traite d'une couche plus forte avec des données vérifiées. L'architecture conserve la qualité, la confidentialité et la possibilité de contrôler.