Le fossé n’est pas l’intelligence, ce sont les données
Vous demandez « le cours de NVDA » et un modèle général peut répondre par un chiffre rond. Parfois il tombe juste par hasard. Parfois il mélange séances, splits ou un autre ticker. Il ne ment pas exprès : il complète du texte. Un cours est un fait de marché, pas une phrase plausible.
Il en va de même pour le BPA, le guidance et les chiffres d’un 10-K. Sans le dépôt sous les yeux, le modèle improvise la forme d’une réponse financière. C’est pourquoi un terminal qui interroge et montre l’interrogation est une architecture différente, pas « plus d’IA ».
Ce que mesurent FinanceBench et les hallucinations
FinanceBench a testé GPT-4 sur de vraies questions financières. Sans le contexte du dépôt, la réussite est tombée autour de 9 %. Avec le dépôt, elle est montée autour de 79 %. Le saut n’est pas un tour de prompt : c’est l’accès au document d’où sort le chiffre.
Des analyses du secteur — Daloopa et d’autres — situent les hallucinations sur des tâches financières autour de 41 % sans couche de données vérifiée. C’est cohérent avec le quotidien : le modèle rédige bien et invente le chiffre. Un assistant de recherche web aide ; il ne remplace pas un outil qui renvoie une cotation, un print ou un dépôt horodaté.
FinanceBench : ~9 % de réussite. Le modèle complète une réponse financière sans la source.
FinanceBench : ~79 %. Le même type de question, document en main.
Hallucinations financières autour de 41 % dans des analyses du secteur sans données vérifiées.
Le chiffre vient d’une API ou d’un document ; la trace dit lequel et quand.
Là où ChatGPT continue de gagner
Pour penser à voix haute, rédiger un mémo ou expliquer un concept, ChatGPT est souvent le bon outil. Son amplitude hors marché est plus large. Cala est plus étroit exprès : cotations, structure de marché et dépôts sur un bureau ancrable, plus le Morning Brief si vous voulez le contexte overnight déjà réuni.
Beaucoup de gens utilisent les deux. Le chatbot pour l’argument ; le terminal pour le chiffre. À 39,99 $/mois, Cala ne prétend pas être un siège Bloomberg (~32 000 $/an) ni un courtier. C’est de la recherche, pas de l’exécution.
Des questions auxquelles on ne devrait pas répondre de mémoire
Si la réponse ne peut pas montrer d’où vient le chiffre, ce n’est pas de la recherche : c’est de la prose. Cala est fait pour le premier cas. Informatif uniquement ; vous décidez chez votre courtier.
Cours en direct de NVDA, flux d’options du jour et GEX par strike — cite l’outil de chaque chiffre.Résume le dernier 8-K de ce ticker et signale ce qu’un chatbot général ne pourrait pas savoir sans le dépôt.Compare deux semi-conducteurs sur fondamentaux et notations, avec le tool_step de chaque nombre.FAQ
Pourquoi ChatGPT donne-t-il parfois un mauvais cours ?
Parce qu’il peut répondre de mémoire. Ce chiffre peut être périmé ou d’un autre contexte. Cala interroge la cotation via un outil et pose l’étape dans la trace <code>tool_step</code>.
Qu’est-ce que FinanceBench ?
Un jeu d’évaluation de questions financières. GPT-4 a atteint ~9 % sans le contexte du dépôt et ~79 % avec. Le document compte plus que le style de la réponse.
Cala hallucine-t-il moins parce qu’il est « plus intelligent » ?
Non. Il hallucine moins sur les chiffres de marché parce qu’il les interroge. 168 outils et un <code>tool_step</code> visible ne sont pas un plus gros modèle : c’est une couche de données.
Cala donne-t-il des conseils d’investissement ?
Non. Informatif uniquement, pas un courtier, pas de conseil personnalisé. Les transactions se font chez votre courtier.
Essayez Cala Terminal
Interrogez le terminal, pas la mémoire du modèle. 168 outils, tool_step visible, 39,99 $/mois. Informatif uniquement ; Cala n’exécute aucune transaction.
Ouvrir CalaTélécharger les apps
Comment Cala interroge — et comment il le montre
Cala Terminal ne « se souvient » pas d’une cotation. Il route la question vers des outils de données en direct — 168 au total — et appuie la réponse sur ce que ces outils renvoient. Flux d’options, dark pool, GEX, dépôts SEC et transactions du Congrès sont des interrogations, pas des souvenirs.
Chaque étape apparaît dans une trace
tool_stepvisible et horodatée. Vous voyez quel outil a produit quel chiffre. Cela ne transforme pas l’analyse en conseil : le cadre reste descriptif. Cala ne dit pas quoi acheter ou vendre. Plus dans Cala Terminal vs ChatGPT et, pour les réponses web rapides versus la profondeur, dans Cala Terminal vs Perplexity Finance.