Données

Pourquoi ChatGPT hallucine les cours des actions.

Un chatbot général est extraordinaire pour raisonner. L’échec sur le marché n’est pas l’intelligence : c’est d’affirmer un chiffre que personne ne vient d’interroger. Le modèle sonne sûr. Le cours peut être celui d’hier, d’un autre ticker — ou de nulle part.

Le fossé n’est pas l’intelligence, ce sont les données

Vous demandez « le cours de NVDA » et un modèle général peut répondre par un chiffre rond. Parfois il tombe juste par hasard. Parfois il mélange séances, splits ou un autre ticker. Il ne ment pas exprès : il complète du texte. Un cours est un fait de marché, pas une phrase plausible.

Il en va de même pour le BPA, le guidance et les chiffres d’un 10-K. Sans le dépôt sous les yeux, le modèle improvise la forme d’une réponse financière. C’est pourquoi un terminal qui interroge et montre l’interrogation est une architecture différente, pas « plus d’IA ».

Ce que mesurent FinanceBench et les hallucinations

FinanceBench a testé GPT-4 sur de vraies questions financières. Sans le contexte du dépôt, la réussite est tombée autour de 9 %. Avec le dépôt, elle est montée autour de 79 %. Le saut n’est pas un tour de prompt : c’est l’accès au document d’où sort le chiffre.

Des analyses du secteur — Daloopa et d’autres — situent les hallucinations sur des tâches financières autour de 41 % sans couche de données vérifiée. C’est cohérent avec le quotidien : le modèle rédige bien et invente le chiffre. Un assistant de recherche web aide ; il ne remplace pas un outil qui renvoie une cotation, un print ou un dépôt horodaté.

Sans le dépôt

FinanceBench : ~9 % de réussite. Le modèle complète une réponse financière sans la source.

Avec le dépôt

FinanceBench : ~79 %. Le même type de question, document en main.

Sans couche de données

Hallucinations financières autour de 41 % dans des analyses du secteur sans données vérifiées.

Avec des outils

Le chiffre vient d’une API ou d’un document ; la trace dit lequel et quand.

Comment Cala interroge — et comment il le montre

Cala Terminal ne « se souvient » pas d’une cotation. Il route la question vers des outils de données en direct — 168 au total — et appuie la réponse sur ce que ces outils renvoient. Flux d’options, dark pool, GEX, dépôts SEC et transactions du Congrès sont des interrogations, pas des souvenirs.

Chaque étape apparaît dans une trace tool_step visible et horodatée. Vous voyez quel outil a produit quel chiffre. Cela ne transforme pas l’analyse en conseil : le cadre reste descriptif. Cala ne dit pas quoi acheter ou vendre. Plus dans Cala Terminal vs ChatGPT et, pour les réponses web rapides versus la profondeur, dans Cala Terminal vs Perplexity Finance.

Là où ChatGPT continue de gagner

Pour penser à voix haute, rédiger un mémo ou expliquer un concept, ChatGPT est souvent le bon outil. Son amplitude hors marché est plus large. Cala est plus étroit exprès : cotations, structure de marché et dépôts sur un bureau ancrable, plus le Morning Brief si vous voulez le contexte overnight déjà réuni.

Beaucoup de gens utilisent les deux. Le chatbot pour l’argument ; le terminal pour le chiffre. À 39,99 $/mois, Cala ne prétend pas être un siège Bloomberg (~32 000 $/an) ni un courtier. C’est de la recherche, pas de l’exécution.

Des questions auxquelles on ne devrait pas répondre de mémoire

Si la réponse ne peut pas montrer d’où vient le chiffre, ce n’est pas de la recherche : c’est de la prose. Cala est fait pour le premier cas. Informatif uniquement ; vous décidez chez votre courtier.

Cours en direct de NVDA, flux d’options du jour et GEX par strike — cite l’outil de chaque chiffre.
Résume le dernier 8-K de ce ticker et signale ce qu’un chatbot général ne pourrait pas savoir sans le dépôt.
Compare deux semi-conducteurs sur fondamentaux et notations, avec le tool_step de chaque nombre.

FAQ

Pourquoi ChatGPT donne-t-il parfois un mauvais cours ?

Parce qu’il peut répondre de mémoire. Ce chiffre peut être périmé ou d’un autre contexte. Cala interroge la cotation via un outil et pose l’étape dans la trace <code>tool_step</code>.

Qu’est-ce que FinanceBench ?

Un jeu d’évaluation de questions financières. GPT-4 a atteint ~9 % sans le contexte du dépôt et ~79 % avec. Le document compte plus que le style de la réponse.

Cala hallucine-t-il moins parce qu’il est « plus intelligent » ?

Non. Il hallucine moins sur les chiffres de marché parce qu’il les interroge. 168 outils et un <code>tool_step</code> visible ne sont pas un plus gros modèle : c’est une couche de données.

Cala donne-t-il des conseils d’investissement ?

Non. Informatif uniquement, pas un courtier, pas de conseil personnalisé. Les transactions se font chez votre courtier.

Essayez Cala Terminal

Interrogez le terminal, pas la mémoire du modèle. 168 outils, tool_step visible, 39,99 $/mois. Informatif uniquement ; Cala n’exécute aucune transaction.

Ouvrir CalaTélécharger les apps