Vue d'ensemble
Granite 3.1 2B Instruct est un modèle de langage compact conçu spécialement pour suivre des instructions. Contrairement aux modèles plus volumineux qui exigent d'importantes ressources de calcul, cette version de 2 milliards de paramètres fournit des réponses rapides et cohérentes à un large éventail de tâches textuelles, du résumé et de la traduction à la génération de code et au raisonnement pas à pas. Il comble un manque pratique : une sortie IA capable et réactive sans la latence ni le coût associés aux modèles plus lourds. Sur Picasso IA, vous pouvez l'exécuter directement dans votre navigateur, sans configuration ni codage requis.
- Rédigez votre instruction ou votre question dans le champ de prompt. Vous pouvez être conversationnel ou très précis, le modèle s'adapte aux deux styles.
- Ajoutez un prompt système si vous souhaitez définir une personnalité ou des règles comportementales avant l'exécution du prompt principal.
- Définissez votre température préférée (plus basse pour des réponses ciblées, plus élevée pour une sortie plus variée) et choisissez une limite maximale de tokens pour contrôler la longueur de la réponse.
- Appuyez sur générer. Le modèle traite votre entrée et renvoie une réponse textuelle, généralement en quelques secondes.
- Vérifiez la sortie, puis ajustez votre prompt ou vos paramètres et régénérez si nécessaire. Il n'y a aucune pénalité à itérer.
Questions fréquemment posées
Ai-je besoin de compétences en programmation ou de connaissances techniques pour l'utiliser ?
Non, ouvrez simplement Granite 3.1 2B Instruct sur Picasso IA, ajustez les paramètres souhaités et cliquez sur générer.
Est-ce gratuit à essayer ?
Oui, vous pouvez exécuter le modèle sans mettre en place un environnement de développement ni écrire de code. La disponibilité et les limites d'utilisation dépendent de votre forfait Picasso IA, mais commencer ne coûte rien.
Combien de temps faut-il pour générer une réponse ?
Les prompts courts à moyens renvoient généralement des résultats en quelques secondes. Les sorties plus longues, comme des résumés détaillés ou du code en plusieurs étapes, peuvent prendre un peu plus de temps selon la charge du serveur et le nombre de tokens.
Quels types de tâches ce modèle gère-t-il bien ?
Il fonctionne de manière cohérente pour le résumé, la traduction, la réponse aux questions, le raisonnement en plusieurs étapes et l'écriture d'extraits de code. Il prend également en charge les tâches de function-calling, ce qui le rend utile pour les scénarios de sortie structurée où la réponse doit suivre un format défini.
Puis-je personnaliser le ton ou le comportement des réponses ?
Oui. Utilisez le prompt système pour attribuer un rôle ou une personnalité au modèle avant l'exécution de votre prompt principal. Le réglage de la température, de top-p et de top-k vous permet de faire évoluer la sortie d'un style précis et prévisible vers un résultat plus ouvert et varié.
Que dois-je faire si la sortie n'est pas celle à laquelle je m'attendais ?
Essayez de reformuler votre prompt avec des instructions plus précises, ou baissez la température pour réduire la variabilité. Les séquences d'arrêt peuvent également aider si vous souhaitez que le modèle coupe la réponse à un mot ou une phrase particulier plutôt que de continuer davantage.