Vue d’ensemble
Llama 2 13B est un modèle de langage de 13 milliards de paramètres conçu pour la génération de texte libre. Si vous devez rédiger du contenu, répondre à des questions, résumer des documents ou créer un prototype de chatbot simple, ce modèle le prend en charge à partir d’un prompt en texte brut, sans aucune programmation requise. Sur Picasso IA, il s’exécute dans votre navigateur afin que vous puissiez tester des idées sans aucune configuration. Il occupe une position intermédiaire pratique : plus grand que la variante 7B pour une cohérence nettement meilleure, tout en restant suffisamment rapide pour une itération réelle.
- Saisissez votre prompt dans la zone de texte. Utilisez une question, une phrase incomplète, une instruction ou un scénario que vous souhaitez voir le modèle poursuivre.
- Ajustez la température pour contrôler à quel point la sortie paraît créative ou prévisible : des valeurs plus faibles restent plus proches de votre prompt, des valeurs plus élevées introduisent davantage de variation.
- Définissez le nombre maximal de tokens pour limiter la longueur de la réponse, ou laissez la valeur par défaut de 128 tokens pour commencer.
- Cliquez sur générer et lisez la sortie en quelques secondes.
- Si le résultat n’est pas bon, ajustez le prompt ou les paramètres et relancez.
Questions fréquemment posées
Ai-je besoin de compétences en programmation ou de connaissances techniques pour utiliser cela ?
Non, ouvrez simplement Llama 2 13B sur Picasso IA, ajustez les paramètres souhaités et cliquez sur générer.
Est-ce gratuit à essayer ?
Oui, vous pouvez utiliser Llama 2 13B sans configuration de compte ni paiement requis pour commencer.
Combien de temps faut-il pour obtenir des résultats ?
La plupart des réponses sont générées en quelques secondes. Les sorties plus longues avec des nombres de tokens plus élevés prennent un peu plus de temps, mais vous voyez généralement des résultats en moins de 30 secondes.
Quels formats de sortie sont pris en charge ?
Le modèle renvoie du texte brut. Vous pouvez le copier directement dans n’importe quel document, e-mail ou application sur lequel vous travaillez.
Puis-je personnaliser la qualité ou le style de la sortie ?
Oui. Le curseur de température contrôle à quel point l’écriture est ciblée ou variée. Les réglages de sampling top-p et top-k vous offrent un contrôle plus fin sur les choix de mots que le modèle prend en compte à chaque étape.
Combien de fois puis-je exécuter le modèle ?
Il n’y a pas de limite stricte au nombre de générations. Exécutez-le autant de fois que nécessaire pour obtenir la sortie souhaitée.
Que se passe-t-il si je ne suis pas satisfait du résultat ?
Ajustez votre prompt pour qu’il soit plus précis, baissez la température pour une sortie plus prévisible, ou utilisez des séquences d’arrêt pour couper la réponse à un point naturel. De petits changements de prompt produisent souvent des résultats nettement différents.