← Mode d’emploi

Documents avec l’IA : composants, validation et tests

L’IA assemble des composants selon vos besoins. Nous testons des tâches réelles pour améliorer le rendu et les modifications.

Comparaison des approches

Les avantages d’OWL Compose face à la génération directe et aux modèles

La génération directe est rapide, mais le résultat dépend du modèle. Les modèles de page sont stables, mais limitent ce qu’on peut créer. OWL Compose permet de composer librement, de finir proprement et de continuer à modifier l’œuvre.

  1. Génération directe par IA

    Le résultat arrive vite, mais sa qualité dépend à chaque fois du modèle.

    Résultat rapideGrande liberté
  2. Modèles IA

    Le démarrage est simple et le résultat stable, mais le contenu et la mise en page restent limités.

    Prise en mainRésultat stable
  3. OWL Compose

    Compose librement mises en page, graphiques et visuels, puis continue à modifier et publier.

    FinitionModification continue
Comparaison conceptuelle

Six capacités concrètes, avec des forces différentes

La génération directe mène en vitesse et liberté, les modèles en stabilité, OWL Compose équilibre mieux l’ensemble du processus.

Génération directe par IAModèles IAOWL Compose

Tests continus

Une œuvre réussie ne devrait pas exiger le modèle le plus cher

Nous testons OWL Compose avec des modèles de référence proches de la frontière prix–performance. Les tâches et la configuration restent fixes, puis nous retestons après chaque évolution du modèle.

Abstraction adaptative

De la structure là où l’IA en a besoin, de la liberté ailleurs

La couche d’écriture n’est pas uniformément abstraite ou détaillée. Chaque limite dépend de ce que les modèles de référence créent avec fiabilité.

Difficile pour l’IA
Encapsuler la complexité

Graphiques avancés, mises en page spatiales et interactions coordonnées deviennent des composants testés avec quelques paramètres utiles.

Quelques paramètres → rendu avancé et stable
Facile pour l’IA
Exposer les atomes

Quand les modèles savent composer de façon fiable, nous divisons la capacité en primitives plus fines plutôt que de l’enfermer dans un modèle.

Syntaxe fine → davantage de liberté créative
Ablation régulièreRetirer, fusionner, scinder, puis retester.

Avec les mêmes modèles de référence et des tâches fixes, nous faisons régulièrement l’ablation de chaque couche. Une limite ne reste que si les preuves montrent son utilité.

Frontière prix–performance

15 configurations · AA v4.2 · USD / tâche

OpenAIZ AIDeepSeekMiniMaxGoogleMetaKimiAnthropic
GPT-5.6 Luna (max): $0.1, 43GLM-5.3-Flash: $0.18, 46DeepSeek V4 Flash 0731 (max): $0.14, 41MiniMax-M3: $0.23, 36DeepSeek V4 Pro 0813 (max): $0.33, 42Gemini 3.1 Pro Preview: $0.34, 37Gemini 3.7 Flash (high): $0.55, 45GPT-5.6 Terra (max): $0.81, 47Muse Spark 1.3 (max): $0.96, 53GPT-5.6 Sol (max): $1.25, 51GLM-5.3 (max): $1.26, 49Kimi K3 (max): $1.58, 50GPT-6 Astra (max): $2.57, 55Claude Opus 5 (max): $4.21, 54Claude Fable 5.1 (max, fallback): $6.12, 57GPT-5.6 Luna (max)GLM-5.3-FlashMuse Spark 1.3 (max)Claude Fable 5.1 (max, fallback)$0.1$1$1030405060Coût par tâche (USD · log)
Artificial Analysis mesure la capacité générale des modèles, pas la qualité des œuvres OWL Compose.

Les points colorés forment l’enveloppe supérieure en coût logarithmique. Gris : alternative moins chère et au moins aussi performante. Creux : sous l’enveloppe. Échantillon sourcé, pas classement complet. Les candidats doivent passer nos tests de qualité ; coûts inconnus exclus.

15 configurations · AA v4.2 · USD / tâche
ModelUSDAA v4.2Frontière prix–performance
GPT-5.6 Luna (max)0.1043Candidat de référence
GLM-5.3-Flash0.1846Candidat de référence
DeepSeek V4 Flash 0731 (max)0.1441Dominé
MiniMax-M30.2336Dominé
DeepSeek V4 Pro 0813 (max)0.3342Dominé
Gemini 3.1 Pro Preview0.3437Dominé
Gemini 3.7 Flash (high)0.5545Dominé
GPT-5.6 Terra (max)0.8147Sous l’enveloppe
Muse Spark 1.3 (max)0.9653Candidat de référence
GPT-5.6 Sol (max)1.2551Dominé
GLM-5.3 (max)1.2649Dominé
Kimi K3 (max)1.5850Dominé
GPT-6 Astra (max)2.5755Sous l’enveloppe
Claude Opus 5 (max)4.2154Dominé
Claude Fable 5.1 (max, fallback)6.1257Candidat de référence