Les 10 risques et ce que Hackaiz contrôle
| Risque | Ce que cela signifie | Ce que Hackaiz contrôle |
|---|---|---|
| LLM01 Injection de consignes | Une saisie piégée contourne les instructions du modèle. | Consignes témoins sur les points d’accès autorisés ; relecture du chemin du texte utilisateur vers le prompt. |
| LLM02 Divulgation d’informations sensibles | Le modèle révèle des secrets, des données personnelles ou son contexte. | Recherche de clés, prompts système et contexte renvoyés dans les réponses ou les journaux. |
| LLM03 Chaîne d’approvisionnement | Modèles, paquets ou extensions compromis. | Dépendances vulnérables connues et versions non figées dans le dépôt. |
| LLM04 Empoisonnement des données et du modèle | Données d’entraînement ou de recherche modifiées pour changer le comportement. | Relecture de qui peut écrire dans les sources de recherche (pas un audit du modèle). |
| LLM05 Mauvaise gestion des sorties | Sortie du modèle utilisée sans précaution (HTML, SQL, shell). | Chemins où la sortie est affichée, exécutée ou requêtée sans validation. |
| LLM06 Autonomie excessive | Outils plus puissants que nécessaire. | Permissions d’outils qui écrivent, suppriment, envoient ou récupèrent n’importe quelle URL (SSRF). |
| LLM07 Fuite du prompt système | Les instructions ou secrets du prompt système sont exposés. | Consignes témoins demandant le prompt système ; secrets placés dans les prompts. |
| LLM08 Faiblesses des vecteurs et embeddings | La recherche renvoie les données d’autres utilisateurs. | Règles d’accès sur les tables de vecteurs (par exemple RLS Supabase). |
| LLM09 Désinformation | Réponses fausses mais affirmées, sur lesquelles on s’appuie. | Non testé automatiquement ; indiqué comme non vérifié. |
| LLM10 Consommation illimitée | Aucune limite de requêtes, de jetons ou de coût. | Absence de limitation, authentification désactivée par défaut, réglages de modèle contrôlés par l’appelant. |
Comment utiliser cette liste
- Commencez par LLM01, LLM02, LLM06 et LLM07 : ce sont les causes de la plupart des fuites réelles.
- Ne mettez jamais de secret dans un prompt système ; partez du principe qu’il peut être extrait.
- Donnez à chaque outil la permission minimale et bloquez les adresses internes pour la récupération d’URL.
- Limitez le débit et exigez une authentification sur chaque point d’accès IA.
Limites honnêtes
Une analyse ne peut pas prouver qu’un modèle ne dérapera jamais. Hackaiz montre ce qu’il a testé, les consignes envoyées et les réponses reçues, et liste explicitement les risques non contrôlés au lieu de les déclarer sûrs.