À propos · Clermont-Ferrand · depuis 2019

Tensorfoundrycorp : louer des GPU plutôt que gérer un datacenter

Tensorfoundrycorp est un opérateur français de calcul accéléré qui loue des serveurs GPU H100 et A100 à l'heure, au mois ou au trimestre, depuis une salle technique à Clermont-Ferrand.

2019 première baie allumée avec huit V100 d'occasion
14 personnes à l'effectif, dont neuf sur la plateforme
256 GPU en parc aujourd'hui

L'origine

On a commencé par acheter nos propres cartes. Mauvaise idée.

Tensorfoundrycorp est née d'un constat un peu bête. En 2018, deux d'entre nous entraînaient des modèles de vision sur quatre cartes achetées à crédit dans un local prêté par une école d'ingénieurs. Le modèle a fini par fonctionner, mais la facture d'électricité, le bruit des ventilateurs et la carte mère grillée au bout de onze mois ont eu raison du projet. On a revendu le matériel et décidé de faire autrement.

L'idée suivante était simple : garder le matériel là où il est rentable, c'est-à-dire chez quelqu'un qui ne l'utilise pas seulement les trois semaines de son cycle d'entraînement. Une carte qui tourne à 30 % de charge pendant huit mois ne vaut pas mieux qu'une carte louée à l'heure, sauf qu'elle coûte le même prix. C'est ce raisonnement qu'on vend aujourd'hui, pas de la puissance brute.

La première baie est montée en 2019 avec huit V100 rachetées à un laboratoire qui fermait. Elles chauffent encore, deux d'entre elles servent de banc d'essai pour les scripts de reprise sur incident.

Ce qu'on croit

Trois principes qu'on refuse de négocier

Facturer ce qui tourne

Une carte au repos ne coûte presque rien à faire fonctionner. La facturer au client reviendrait à lui vendre du silence. On facture à la seconde, avec un minimum d'une minute, et la réservation expire toute seule après quinze minutes sans activité GPU.

Annoncer la vraie vitesse

Le passage de huit à seize cartes ne divise pas le temps par deux, on plafonne à 62 % d'efficacité linéaire. On le dit avant le devis, pas après la facture. Trois clients nous ont remerciés de les avoir dissuadés de surdimensionner.

Effacer vraiment

Les disques sont remis à zéro à la fin de chaque réservation. Aucune donnée de client ne sert à entraîner un modèle qui n'est pas le sien. La procédure est décrite dans notre politique de confidentialité.

La salle

Ce qui se trouve vraiment dans nos racks

Quatre baies en colocation à Clermont-Ferrand, sous contrat avec un hébergeur local. Pas de cloud surdimensionné, pas de nœuds partagés entre clients. Vous réservez une machine, elle est à vous pendant toute la durée du run.

L'équipe

Neuf personnes sur la plateforme, cinq ailleurs

On est assez petits pour que la personne qui répond au téléphone soit celle qui répare un nœud à trois heures du matin. C'est parfois fatigant, c'est surtout très efficace quand un client a un vrai problème.

Marc-Antoine Lefebvre, président

Marc-Antoine Lefebvre

Président, cofondateur

Ancien ingénieur système chez un hébergeur régional. Il a passé les cinq premières années de Tensorfoundrycorp à câbler des baies et à expliquer à des clients pourquoi leur job n'utilisait pas la carte qu'ils payaient.

Camille Berthier, ingénieure plateforme

Camille Berthier

Ingénieure plateforme

Elle a supervisé plus de quatre cents entraînements multi-nœuds sur notre cluster. C'est elle qui refuse les devis quand la configuration demandée va coûter plus cher au client pour un gain nul.

Hélène Duprat, responsable infrastructure

Hélène Duprat

Responsable infrastructure

Vient du monde des réseaux opérateurs. Elle a fait passer notre interconnexion de nœuds d'un mélange Ethernet hétérogène à un InfiniBand 400 Gb/s non bloquant, ce qui nous a fait gagner 190 000 heures GPU par an.

Félix Andraud, responsable support

Félix Andraud

Responsable support

Il tient la permanence technique 24h/24 en rotation avec deux collègues. Réponse moyenne sur incident matériel : onze minutes. Réponse sur une question de configuration : dans l'heure.

Engagements

Ce qu'on s'engage à faire, et à ne pas faire

01

Réponse en une heure ouvrée

Toute demande envoyée entre 9h et 18h30 du lundi au vendredi reçoit une réponse humaine, pas un accusé de réception automatique.

02

Aucun frais caché

Pas de frais de mise en route, pas de facturation au volume sortant à partir du moment où vous restez sous 500 Go par mois. Le reste est sur la page tarifs.

03

Remplacement matériel sans facturation

Si une carte tombe en panne pendant votre run, on bascule le job et vous ne payez pas le temps de reprise. Le détail figure dans la politique de remboursement.

04

Pas de revente de vos données

Ni vos jeux de données, ni vos modèles, ni vos métriques ne sortent de la salle. On ne fait pas de veille concurrentielle sur nos clients, c'est écrit noir sur blanc dans nos conditions générales d'utilisation.

Nos offres

Ce qu'on loue concrètement

01

Location de serveurs GPU H100 et A100 à l'heure

Un nœud, une carte, une heure. Pour les phases de prototypage et les campagnes d'essais qui changent d'hyperparamètres toutes les deux heures, c'est la formule qui tient le mieux.

à partir de 3,20 € / h

Voir l'offre

02

Cluster multi-nœuds pour entraînement distribué

Huit à trente-deux nœuds reliés en InfiniBand 400 Gb/s. C'est la seule configuration qui encaisse les modèles au-delà de trente milliards de paramètres sans passer la nuit sur les transferts.

à partir de 25,60 € / h

Voir le cluster

Le blog

Ce qu'on publie entre deux runs

Des mesures, des retours d'incident et des calculs de coût. Rien qui ressemble à une plaquette commerciale.

Voir tous les articles

Nous joindre

Le bureau est au centre de Clermont-Ferrand

On reçoit sur rendez-vous, principalement parce que la plupart des visites finissent en salle technique et que la salle technique ne se visite pas à l'improviste.

+33 4 73 92 84 51
tensorfoundrycorp@gmail.com
Michelin, 12 Cours Sablon, 63000 Clermont-Ferrand, France
Support technique 24h/24, accueil commercial du lundi au vendredi de 9h00 à 18h30.

Prochaine étape

Passez nous voir ou envoyez-nous votre config

Décrivez le modèle, la taille du dataset et le nombre d'époques. On vous répond avec une durée estimée et un prix à l'heure, sans engagement et sans relance commerciale.