📱

Get Our Mobile App

Take your business learning on the go!

Download on the App StoreGet it on Google Play

Do THIS Before You Lose Access to Fable 5

Mark Kashef13:59

Transcription

Alors, si vous payez actuellement pour du code cloud, il vous reste quelques jours pour utiliser Fable 5 dans le cadre de votre abonnement existant, du moins pour l'instant. Et après cela, la majorité d'entre nous n'utiliseront pas Fable, ou du moins ne l'utiliseront pas autant car les coûts sont exorbitants. Ils paniquent et lancent des centaines de milliers de jetons sur des tâches aléatoires avant que le temps ne s'écoule, ou ils haussent simplement les épaules et l'utilisent à peine pour commencer. Mais le but de cette vidéo est de vous donner une troisième option. Une qui prend la chose la plus précieuse que je trouve à propos de Fable 5 et vous permet de l'utiliser bien après qu'elle ne fasse plus partie de votre abonnement.

Maintenant, avant de perdre Fable, j'ai publié une vidéo expliquant comment vous pouviez parcourir vos conversations précédentes pour en extraire son intelligence brute. Mais bien que vous l'ayez toujours, nous pouvons l'utiliser d'une manière dont presque personne ne parle. Et non, il ne s'agit pas simplement de construire toutes les idées que vous avez. Et il ne s'agit pas non plus de construire de simples fichiers de plan. Il s'agit de construire quelque chose d'infiniment plus puissant qui donne à pratiquement n'importe quel modèle la capacité de parcourir ce que Fable aurait fait et de s'exécuter. Donc, si vous voulez dépenser les derniers jetons et le dernier temps que vous avez avec ce modèle, du moins pour l'instant, de la meilleure façon possible, alors plongeons.

Maintenant, si vous lisez les notes de publication officielles d'Anthropic, ils disent que Fable est un excellent exécuteur pour les tâches à long terme et que vous devriez lui donner un plan créé par quelque chose comme Opus. Vous ne devriez apparemment pas utiliser Fable pour la planification car c'est un gaspillage de ces précieux jetons. Et si nous parlons purement de planification, alors ce conseil a du sens. C'est l'équivalent d'amener un chirurgien de premier ordre et de lui demander de vous écrire un diagramme de la façon dont vous opéreriez sur quelqu'un, par opposition à le faire réellement.

Donc, la solution n'est pas de demander de meilleurs plans. C'est en fait de ne pas demander de plans du tout. Il y a quelques jours, l'un des meilleurs ingénieurs d'Anthropic a publié un article expliquant comment vous devriez utiliser des modèles comme Fable pour vous aider à comprendre les inconnues d'un certain projet. Et la grande idée est qu'avec un modèle aussi capable, vous n'êtes plus limité par l'intelligence brute. Vous êtes limité par les choses que vous ne savez pas en tant qu'orchestrateur, en tant que personne fournissant les instructions, les plans et les invites à ce type de modèles.

Maintenant, pour la plupart d'entre nous, lorsque nous commençons un projet, nous avons une assez bonne compréhension des "known knowns" (ce que nous savons que nous savons) et des "known unknowns" (ce que nous savons que nous ne savons pas). Mais généralement, vous pourriez vouloir vous appuyer sur l'intelligence de modèles comme Fable pour des choses comme les "unknown nodes" (les inconnues que nous ne savons pas que nous ne savons pas). Et cela pourrait être la connaissance tacite que vous supposez que le modèle linguistique connaît, mais même avec ce niveau d'intelligence, il pourrait ne pas avoir votre niveau d'expérience de vie ou de connaissance tacite. Et puis vous avez les "unknown unknowns" (les inconnues que nous ne savons même pas que nous ne savons pas) où vous ne savez même pas que c'était un domaine qui méritait d'être exploré ou d'être interrogé. Vous pouvez donc implorer et solliciter des modèles comme Fable pendant le temps dont vous disposez pour extraire ces questions et vous guider dans des domaines où vous n'auriez jamais pensé aller auparavant.

Maintenant, ce concept est le cœur de la vidéo et je ne vais pas seulement vous l'expliquer conceptuellement. Je vais vous montrer concrètement comment vous pouvez le mettre en œuvre. Au lieu de créer un plan normal où même avec un modèle aussi intelligent que Fable, il supposera la linéarité, un scénario idéal, il décomposera un plan en phases et le créera d'une manière très logique. Il est très attendu qu'il ait un haut degré de succès, mais en réalité, il ne démontre pas vraiment ce qui pourrait arriver si les choses ne se passent pas comme prévu.

L'objectif du "wargaming" est que vous demandiez à l'IA de décomposer chaque cours d'action, étape par étape, et chaque scénario possible qu'elle pourrait rencontrer en fonction de son expérience antérieure. Vous pouvez donc y penser comme trois éléments principaux. Vous avez l'action, la réaction et la contre-action. L'IA fait un mouvement, puis la réalité l'humilie en lui lançant une forme d'erreur, puis elle doit prendre une forme de contre-action pour essayer de résoudre cette erreur. Et c'est ce que nous appelons la boucle agentique moderne.

Pour rendre cela plus tangible, disons que vous avez construit une plateforme entière et que vous vouliez utiliser Fable pour développer cette nouvelle fonctionnalité qui permettrait aux utilisateurs d'atteindre un point d'API et de récupérer une forme de données. Un plan normal se contenterait de décomposer exactement comment il pourrait construire ce point d'API. Mais un "war game" dirait essentiellement : "Utilisez ce plan, mais supposez qu'à chaque étape, il y aura quelques scénarios possibles différents. Sur la base de votre expérience, comment géreriez-vous ces scénarios ?"

Si vous avez tout cela documenté, alors si vous donnez ce même plan à quelque chose comme un Opus 4.8 ou un GPT 5.5 ou peut-être même un modèle open-source très sophistiqué comme GLM, alors il est fort probable qu'il aura beaucoup plus de facilité à combiner son expertise avec la compréhension de toutes les réalités possibles qui ont déjà été simulées par Fable et à les exécuter avec beaucoup plus de confiance.

Maintenant, comme pour toute simulation, vous devez définir une fin. J'aime appeler cela une conséquence de deuxième, troisième, quatrième ordre. Et ce sont les choses possibles qui pourraient arriver quelques couches plus bas à partir de l'action initiale. Il ne s'agit donc pas seulement de construire le site Web. Il s'agit de penser à tous les différents problèmes liés à la construction d'un site Web de cette manière. Peut-être deux ou trois scénarios différents qui pourraient survenir. Et c'est là que vous intervenez et décidez jusqu'où aller dans le "war game" d'un scénario donné.

Sur la gauche, vous avez ce que la plupart des gens auront le 8 juillet, où ils perdent temporairement l'accès à Fable, qui sont une série de plans qui ont exécuté ces constructions à environ 80 % du chemin, puis ils doivent revenir à quelque chose comme Opus 4.8 ou un autre modèle linguistique pour terminer l'exécution des 20 % restants, ce qui est ironiquement souvent l'une des choses les plus difficiles à faire.

Cependant, ce que vous pourriez avoir, ce sont une série de projets et vos idées les plus difficiles entièrement simulées et "wargamed" au point où vous pouvez les exécuter à votre disposition et à votre guise.

Voilà donc le conceptuel, et maintenant nous allons passer à l'application pratique.

Très bien, disons que nous avons 10 idées et projets très substantiels que nous aimerions que Fable construise de bout en bout, avec toute la bande passante et les jetons du monde. Je ne vais pas passer en revue chaque invite de manière exhaustive. Je les mettrai toutes à votre disposition dans le deuxième lien ci-dessous, mais nous allons examiner la toute première plus en détail.

L'invite commence comme suit. Elle dit : "Ordre de wargame. Vous n'exécutez pas cette mission. Vous la simulez purement." Et un modèle linguistique saura la différence entre un plan et un "war game". Nous pouvons également lui dire qu'un modèle exécuteur moins cher exécutera le briefing ci-dessous. Et cela pourrait être utile car vous pourriez essentiellement lui dire que cela sera exécuté par Opus. N'hésitez donc pas à consulter toute la documentation d'Anthropic sur Opus pour adapter cette invite et ce "war game" de manière à ce qu'il fonctionne bien avec ce modèle. Et c'est le modèle de base qui est le même entre toutes les invites. Ensuite, simulez la mission sur papier, étape par étape, et écrivez-la dans un fichier war games/website.mmarkdown.

La clé ici est que je ne veux pas que vous implémentiez toutes ces choses séparément. Vous pouvez préparer tous vos fichiers de "war game", vos invites, et faire exécuter toutes ces invites par Claude Fable en même temps. Ensuite, nous pourrons boucler pour revoir, rééditer et optimiser tout cela.

Maintenant, une nuance ici est que je vous montre chacune de ces invites une par une. Mais idéalement, vous ferez ce que je vais vous montrer bientôt, où j'ai exécuté toutes ces idées en même temps, en masse.

En continuant avec l'invite, chaque mouvement indique son observation attendue, exactement ce que vous devriez voir si cela a fonctionné, et ensuite inversement, ce qu'il devrait voir si cela n'a pas fonctionné. Ainsi, chaque mouvement porte son échec le plus probable, la cause de ses signaux, et le contre-mouvement. Il suppose essentiellement ce qui pourrait arriver, un scénario pessimiste et un scénario optimiste.

Là où des modèles comme Opus 4.8 et d'autres échouent, c'est qu'ils sont très myopes. Ils examinent peut-être une poignée de problèmes différents, puis vous devrez faire appel à quelque chose comme CodeX pour surveiller ses épaules afin de vous assurer qu'il fait la bonne chose et qu'il fait les bonnes hypothèses. Et puis, très similaire à traverser un labyrinthe, chaque bifurcation a un déclencheur et si vous observez X, alors vous devriez dire que vous devriez prendre cette route si cela se produit par rapport à cela.

Ensuite, nous disons les hypothèses que votre reconnaissance ou votre diligence raisonnable n'a pas pu résoudre. En gros, signalez-le-nous. Et puis nous terminons en disant "finir avec les conditions d'abandon". Donc, à quel moment le plan devrait-il cesser de s'exécuter s'il rencontre un certain type d'erreur ? Disons qu'il n'a pas accès à un certain type de système. Ce serait un blocage complet pour l'exécution du plan.

Et puis, sous ce briefing de mission, vous décrivez exactement ce que vous essayez de faire. Donc, dans ce cas, pour le cas d'utilisation du marketing de site Web, nous disons simplement : "Je reconstruis le site marketing pour [nom de l'entreprise] car l'actuel présente un problème. Les visiteurs sont votre ICP, votre public." Et ensuite, ce que je veux, c'est un appel à l'action : "construire un site Web statique complet dans le framework de votre choix, et voici les sections que je veux. Voici la description de l'URL. Je veux le rendre mobile d'abord et quand vous pensez avoir terminé, vérifiez avant de signaler, ouvrez chaque page, testez chaque lien, etc." Vous dites donc essentiellement quels sont les différents chemins de test dont ce "war game"/plan doit être conscient.

Et comme je l'ai dit, chaque autre invite ressemblerait très probablement à ceci, où vous auriez le même modèle en haut. Vous décririez les briefings de mission en bas. Donc, dans ce cas, pour la rédaction de contenu, il vous suffit de remplir les blancs pour des choses comme : "Pour qui écrivez-vous le contenu ? Quel est l'ICP ? Quel est l'état mental de la personne qui lit ce contenu ?" Et ensuite, vous parcourez la voix de la marque, et vous lui direz : "Nous voulons rédiger chaque section, le titre, etc."

Voici un cas d'utilisation que vous n'auriez peut-être pas envisagé. Et si vous utilisiez Fable 5 pour vous aider à planifier la construction de votre configuration complète d'IA locale ? Parce qu'il est très évident dans un avenir pas si lointain, nous allons décharger de plus en plus de tâches sur des modèles open-source et très bon marché plutôt que de traiter tout ce drame de Fable.

Votre invite pourrait ressembler à ceci : "Je veux une configuration d'IA open-source entièrement locale sur cette machine, privée par défaut, rien ne quitte la machine." Et ensuite, vous pourriez demander à l'IA d'examiner votre système et de rechercher tous ces éléments différents comme votre système d'exploitation, le type de puce que vous utilisez, votre RAM, si vous avez un GPU, votre espace disque libre, et ensuite vous diriez : "configurez la pile qui convient à cette machine, pas un tutoriel générique. Choisissez le runtime, parcourez tout." Vous pourriez même lui indiquer quelque chose comme LM Studio et lui demander de trouver tous les modèles qui seraient les meilleurs pour votre système spécifique et combien de jetons par seconde vous pourriez obtenir.

Et au-delà de cela, en ce qui concerne des choses comme les impôts, vous pourriez lui demander d'examiner toutes vos optimisations fiscales que vous avez déjà apportées dans votre entreprise ou dans l'entreprise pour laquelle vous travaillez déjà et de voir, du point de vue d'un comptable, toutes les différentes façons dont vous pourriez rechercher des optimisations. Vous pourriez faire la même chose pour la gestion des offres. Vous pourriez également, si vous avez une application ou une plateforme de chatbot existante, nous en avons toutes sortes de ma communauté. Comment pouvez-vous les optimiser et les mettre en œuvre d'une manière où il y a une sorte d'auto-évaluation de toutes les erreurs qui se sont produites dans le passé ? Et vous pouvez appliquer cela à toutes sortes de cas d'utilisation, y compris la correction de bugs, les modèles financiers, l'examen de différents modèles concurrents, la façon dont vous pouvez optimiser votre utilisation de ceux-ci, comment vous pouvez gérer un conseil consultatif où vous pouvez mélanger et assortir votre utilisation de Claude, CodeX et de modèles open-source également.

Naturellement, vous avez un nombre illimité de cas d'utilisation, mais une fois que vous avez votre liste de projets et d'idées les plus urgents que vous souhaitez exécuter, vous passez à l'étape suivante.

Une fois que vous êtes prêt, vous pouvez créer un nouveau dossier. Et ce dossier, vous pouvez l'appeler "la dernière semaine de Fable", évidemment pour l'instant. Et ensuite, dans ce dossier, vous pouvez le diviser en quelques sous-dossiers : "Tasks", "War games", "Success file" et "Ledger file". Le "Success file" contiendra vos critères que nous avons mentionnés en passant dans les invites ci-dessus quant à ce que vous considérez comme un "war game" réussi. Si nous allons au fichier "Success MD", voici à quoi il pourrait ressembler. Le vôtre pourrait avoir plus de règles, moins de règles, des règles plus strictes, ou même des règles plus détaillées.

Et puis le "ledger", le but est de signaler tout endroit où il est bloqué. Donc, s'il simule un "war game" et qu'il y a une forme de variable indéfinie, il devrait remplir un petit espace réservé pour une variable entre parenthèses pour quelque chose qui nécessite votre contribution.

Et enfin, vous exécuterez cette invite que j'ai déjà exécutée avant de lancer cette vidéo, qui est "/goal". Chaque fichier de mission dans /tasks a un premier brouillon de "war game". Parcourez chacun, bouclez et faites la mission de reconnaissance pour chaque mission. Écrivez un fichier "war games" et ensuite rédigez les 10 avant de polir l'un d'eux. Et une fois que nous aurons tous ces brouillons, vous pourriez faire quelque chose comme théoriquement exécuter "/loop" toutes les 20 minutes, boucler à travers chaque premier brouillon jusqu'à ce que vous le poussiez vraiment à ses limites. Et une fois que vous commencerez à l'exécuter, il déploiera une série d'agents parallèles pour aller exécuter chacune de ces tâches en même temps. Ainsi, après un million de jetons, vous pourriez avoir un dossier "war games" entièrement rempli. Et vous pouvez même avoir un fichier "assumptions" à l'intérieur. Il contiendra un fichier markdown complet détaillant chaque partie des entrées supposées, la reconnaissance nécessaire, les différents chemins qu'il pourrait emprunter, les différents mouvements et considérations qu'il pourrait prendre tout au long de ce processus. Vous pouvez voir ici, très complet, chaque mouvement possible qu'il pourrait faire, et l'action, réaction et contre-action possibles qui seraient requises.

Donc, théoriquement, vous avez 10 plans différents que vous pourriez fournir à n'importe quelle IA pour exécuter lesdits projets. Et comme je l'ai dit, si le "ledger" est bloqué pour une raison quelconque, cela ressemblerait à ceci, où il vous indiquerait les entrées nécessaires pour débloquer, disons, le type d'entreprise, le problème que nous résolvons, le public, tout ce que vous n'avez pas pu spécifier. Dans mon cas, comme je vous montre simplement cela comme une démo, je lui ai demandé d'assumer différentes valeurs pour ces variables.

Et comme je l'ai dit, vous pouvez passer au niveau supérieur en étiquetant un agent Claude Code Guide et en disant : "Je veux que vous adaptiez ce "war game" exactement à la façon dont Sonnet 5 l'exécuterait. Très adapté à son comportement spécifique." Et cela lancerait un sous-agent ou des sous-agents pour parcourir toute la documentation, peut-être la carte système de ce modèle pour s'assurer qu'il est aussi adapté et personnalisé que possible.

Et c'est à peu près tout. Ce n'est pas de la science de fusée, mais c'est vraiment prendre le paradigme de la planification et le pousser à son extrême naturel où vous pouvez tirer parti de tous les avantages et de l'intelligence brute de Fable pour extraire comment il ferait quelque chose et simplement l'émuler avec des modèles existants qui sont beaucoup moins chers et qui, espérons-le, ne disparaîtront pas en un clin d'œil.

Et comme je l'ai dit, je mettrai à votre disposition toutes les invites que je vous ai montrées ci-dessous, ainsi que cette structure de dossiers, afin que vous puissiez l'émuler si vous le souhaitez. Et comme toujours, si vous voulez passer au niveau supérieur en général avec des choses comme le code cloud, CodeX et les flux de travail agentiques en général, assurez-vous de consulter le premier lien ci-dessous. Je publie toutes sortes de pépites que vous ne verrez jamais sur YouTube dans ma communauté des premiers adoptants. Et pour le reste d'entre vous, si vous avez trouvé cela utile et nouveau, j'apprécierais énormément un pouce bleu sur la vidéo. Cela aide la vidéo, aide à la portée et à la chaîne. Et je vous verrai tous dans la prochaine.