Maîtriser les coûts des modèles d'IA en optimisant le ratio intelligence-prix avec les modèles proposés par Capten
Comment on fait pour maîtriser les coups ? Par exemple, si je mets mon opus 5 dans Capten, comment je m'assure que je ne me retrouve pas avec une facture de 5 000 euros à la fin du mois ? Parce qu'avec des fonctions argentiques, j'imagine que ça consomme plus de token qu'une conversation classique avec un chatbot. C'est la raison pour laquelle on a développé nos propres cerveaux. Quand je dis « développé », on est bien d'accord. On développe pas nos propres modèles d'IA. On agrège des modèles d'IA qui visent sur le marché. On va chercher ceux qui sont les plus performants pour le coup le moins important. Bien sûr, tu peux installer ton opus 5 avec ta clé opus dans Capten. Ce n'est pas dans Capten que tu vas limiter la consommation des coups. C'est dans ta console anthropique que tu vas le faire. Capten va consommer tes propres tokens. Ce que nous, en interne, et puis les utilisateurs les plus aguerris, ont plutôt tendance à utiliser les modèles proposés par Capten, parce que le ratio intelligence-coup est optimisé. Et GENU c'est très performant. On atteint des capacités équivalentes à fable ou au opus 5, pour un coup parfois jusqu'à 10 fois inférieur. Et puis Nano fait ce qu'il faut pour les tâches quotidiennes. Et puis Optimal est un tout petit peu meilleur. Moi je navigue entre GNews et un modèle expérimental que j'ai découvert il n'y a pas si longtemps parce que le modèle est sorti. J'utilise beaucoup Meta Muse 1.2 qui est très étonnant, parce que très efficace et assez peu cher finalement. Encore une fois, on est le 19 foot. Si ça se trouve, dans une semaine, je vais basculer sur un autre modèle qui sera encore plus performant. Ça c'est aussi la force de Capten.