**Sébastien Couasnon** (0:00)
C'est le teaser de tech 45 Chaque semaine, je te propose une plongée dans la French tech, les histoires, les choix, les coulisses, racontés directement par celles et ceux qui les construisent au quotidien. Là, tu as un extrait de quelques minutes pour te mettre l'eau à la bouche. Si tu veux la version complète, l'épisode sort chaque vendredi matin sur ta plateforme de podcast préférée. Abonne-toi, lâche 5 étoiles et un petit avis si ce podcast te plaît. Ça boost énormément tech 45 Moi, c'est Seb Quannon. On se retrouve ici chaque semaine. Si tu veux me suggérer un invité ou me faire un retour, tu peux me contacter directement sur LinkedIn ou sur X. Merci d'être là et bon teaser.
Tu t'es pas non plus pris pour Superman en mode nous on va le faire, on va y arriver tout seul.
Je t'ai dit, il faut peut-être faire un pas de côté. Donc tu pèses du cerveau pour faire court aux data d'entreprise.
**Alexandre Pasquiou** (0:50)
C'était trop tôt et donc je me suis dit, c'est pas moi qui vais inventer le hardware pour acquérir les images. Il y a besoin d'au moins une dizaine d'années et même en parallèle, c'était l'explosion de l'IA appliquée au langage avec les LLM. Il y avait OpenAI, Anthropic, Google qui commençait à exploser.
**Sébastien Couasnon** (1:10)
Donc 2023, tu lances Neuralk.
**Alexandre Pasquiou** (1:13)
Et donc moi je me suis dit bah, la techno sur laquelle se repose c'est LLM. C'est la techno sur laquelle j'ai bossé pendant quatre ans. J'ai disséqué dans tous les sens.
J'ai utilisé pour du texte, pour des images.
**Sébastien Couasnon** (1:25)
Tu saves ce qu'ils savent faire.
Et quasiment jusqu'où on peut les pousser. Et tu connais aussi leurs limites.
**Alexandre Pasquiou** (1:31)
Exactement. Et donc le...
J'ai pris un peu de recul. Je me suis dit ok, ça a appliqué sur l'audio, l'image, du texte, la vidéo. Par contre, il n'y a aucune application de ces modèles sur de la donnée tabulaire. Et quand on prend des tableaux de données avec des lignes et des colonnes, quand on prend...
**Sébastien Couasnon** (1:48)
En gros, un Excel quoi.
**Alexandre Pasquiou** (1:49)
Exactement. Quand on prend un peu de recul, et on se rend compte que la moindre décision qui est faite entreprise, la moindre dépense, c'est une prédiction et qui va se baser sur des tableaux de données. Alors là, par exemple, quand une boîte veut prédire ses revenus, quand elle veut prédire ses ventes, quand une banque veut prédire de la fraude, du risque, ou un hôpital, les pathologies, ou ce que le médicament va fonctionner, à chaque fois, chaque cas d'usage critique pour les entreprises, c'est un cas d'usage de prédiction à partir de données tabulaires avec des lignes des colonnes qui vont se baser sur des bases de données relationnelles, des Excel, des CRM, des ERP.
Et c'est vraiment le cœur de ce qui fait vivre toute l'économie. Sauf qu'aujourd'hui, il y a deux ans et demi, trois ans.
**Sébastien Couasnon** (2:37)
Avant que tu lances ta boîte.
**Alexandre Pasquiou** (2:38)
Exactement. Il n'y avait absolument rien du tout, aucune application de ces modèles de fondation sur les tableaux de données. Donc, on a décidé de lancer Neuralk pour justement translater ce paradigme fondationnel, c'est les modèles de fondation, aux tableaux de données. Un modèle de fondation, pour rappel, c'est un gros modèle d'IA qui est pré-entraîné. Pré-entraîné, c'est-à-dire qu'on va l'entraîner pour une certaine période de temps sur une quantité assez phénoménale de données, en l'occurrence, pour les LLM, c'est du texte qu'ils ont récupéré sur Internet. Pour les modèles de vision, c'est des images. Pour les modèles tabulaires qu'on développe, c'est des tableaux.
Et pourquoi il n'y avait pas ces modèles de fondation à l'époque sur les données tabulaires ? Il y avait pour trois raisons. Première, c'est qu'il n'y avait pas de données disponibles sur Internet comme il y avait pour les modèles de langage ou les modèles de vision.
Donc s'il n'y a pas de données, c'est difficile de pré-entraîner à l'échelle ce genre d'architecture.
**Sébastien Couasnon** (3:33)
Parce que tu ne les partages pas ?
**Alexandre Pasquiou** (3:34)
Parce que c'est la donnée critique des entreprises. Donc elles ne partagent pas leurs ventes, elles ne partagent pas les transactions qui ont lieu.
**Sébastien Couasnon** (3:43)
Si tu es une TBNP, tu partages tes résultats. Mais en fait, c'est que la partie émergée de l'iceberg. Il y a plein de choses qui ne sont pas expliquées, détaillées.
**Alexandre Pasquiou** (3:51)
Ça, c'est la métrique agrégée au plus haut niveau qu'il soit. Mais derrière, il n'y a pas grand-chose qui va être faisable à partir de ça. Tu peux rien en faire.
**Sébastien Couasnon** (3:58)
Voilà, c'est plus de la donnée brute. C'est de la donnée hyper raffinée.
2 more minutes of transcript below
Try it now — copy, paste, done:
curl -H "x-api-key: pt_demo" \
https://spoken.md/transcripts/1000651996090
Works with Claude, ChatGPT, Cursor, and any agent that makes HTTP calls.
From $0.10 per transcript. No subscription. Credits never expire.
Using your own key:
curl -H "x-api-key: YOUR_KEY" \
https://spoken.md/transcripts/1000778852719