
Tout l’historique COT, en un téléchargement.
Chaque marché. Chaque vendredi. Chaque octet.
+380 marchés CFTC, toutes les familles de rapports, de 1986 à aujourd’hui — livrés en CSV et NDJSON dans une archive unique versionnée par schéma.
COT Data Dump
Le COT Data Dump est un achat unique qui vous donne tout le jeu de données historique CFTC Commitments of Traders — les quatre familles de rapports (Legacy, Désagrégé, Traders in Financial Futures, Supplémentaire), chaque marché que la CFTC a jamais publié, en CSV et en NDJSON. Les données CFTC sous-jacentes sont du domaine public fédéral américain (17 USC §105) ; la valeur de ce produit réside dans la curation, le packaging et la vérification SHA-256.
cot-data-dump.zip ├── cot-futures-only.csv Barres hebdomadaires · 1986 → aujourd'hui ├── cot-futures-only.ndjson mêmes données, NDJSON ├── cot-disaggregated.csv Barres hebdomadaires · 2006 → aujourd'hui ├── cot-disaggregated.ndjson ├── cot-tff.csv Barres hebdomadaires · 2006 → aujourd'hui ├── cot-tff.ndjson ├── cot-supplemental.csv Barres hebdomadaires · 2006 → aujourd'hui ├── cot-supplemental.ndjson ├── markets.csv Chaque marché CFTC · code → catégorie ├── COLUMNS.md Référence par colonne pour chaque champ ├── manifest.json SHA-256 par fichier + nombre de lignes └── README.md
Ce qu’il y a dedans
Quatre familles CFTC
Legacy Futures Uniquement, Désagrégé F&O Combined, Traders in Financial Futures et Supplémentaire — toutes dans la même archive.
CSV + NDJSON
Les mêmes données, les deux formats. CSV pour tableurs et analystes, NDJSON pour pipelines de streaming et ingénieurs.
Dictionnaire des marchés
Un markets.csv lie chaque code CFTC à sa catégorie, bourse, unités de contrat et familles de rapports auxquelles il appartient.
Manifeste vérifiable
manifest.json livre les sommes SHA-256 pour chaque fichier plus le nombre de lignes — vous savez que ce que vous avez correspond à ce que nous avons emballé.
Versionné par schéma, stable à vie
Chaque archive est taggée v1, v2, etc. Ajouter une colonne ne casse rien — le schéma reste. La version augmente uniquement quand des colonnes CSV sont renommées, supprimées ou réordonnées, et les clients actifs sont notifiés avant tout changement non rétrocompatible. Épinglez votre pipeline Power Query / Pandas à une version en toute confiance.
Vous possédez ce que vous téléchargez
La CFTC publie les données Commitments of Traders dans le cadre de son mandat réglementaire. Les œuvres fédérales américaines sont du domaine public selon 17 USC §105 — pas de droits d’auteur applicables. Vous pouvez partager, redistribuer, construire des produits payants par-dessus, ou alimenter n’importe quel modèle. Nous ne revendiquons aucun droit sur les données ; la valeur de ce produit est la curation, la discipline du schéma et la vérification.
Construit pour
- Quants qui backtestent des stratégies de positionnement
- Bureaux de recherche construisant des modèles factoriels
- Newsletters qui ont besoin de chiffres hebdomadaires propres
- Analystes fatigués de scraper le site CFTC
- Ingénieurs intégrant le COT dans des dashboards custom
- Équipes IA/ML entraînant des modèles intégrant le positionnement
Livrez plus vite que de scraper vous-même.
Économisez la semaine de plomberie, les edge cases de pagination SODA, les typos de noms de colonnes dans le dataset Supplémentaire. Achetez une fois, ne regardez plus jamais le site CFTC.
Téléchargement immédiat. Re-téléchargement 30 jours. Paiement Stripe sécurisé.
Questions fréquentes
Que reçois-je exactement ?
Un seul ZIP (`cot-data-dump.zip`) contenant quatre CSV et quatre NDJSON — une paire par famille de rapport CFTC — plus `markets.csv` (chaque marché CFTC avec code, place et catégorie), `COLUMNS.md` (référence par colonne pour chaque champ des quatre familles, avec exemples), `README.md` (aperçu + comment vérifier), et `manifest.json` (version de schéma, asOfDate, hash SHA-256 + nombre de lignes par fichier). Environ +380 marchés, historique hebdomadaire jusqu'en 1986 pour la famille Legacy et 2006 pour Désagrégé / TFF / Supplémentaire.
Les données sont-elles vraiment gratuites ailleurs ?
Oui. La CFTC publie les données sous-jacentes sur son site comme domaine public fédéral américain. Vous payez le travail de récupérer chaque dataset, normaliser les erreurs de nom de colonne (la CFTC livre 'postions' au lieu de 'positions' dans le fichier Supplémentaire), empaqueter proprement et fournir un manifeste vérifiable.
À quelle fréquence l'archive est-elle mise à jour ?
L'archive est actualisée automatiquement chaque vendredi, quelques minutes après la publication CFTC de 15:30 ET. Si la CFTC retarde une publication (semaines de fériés US, décalages techniques), notre watcher interroge toutes les heures dans une fenêtre de 4 heures couvrant à la fois l'heure d'été et d'hiver de l'Est — les données fraîches arrivent dès que la CFTC publie, jamais avec des semaines de retard. Chaque téléchargement dans votre fenêtre de 30 jours retourne la dernière archive, pas un instantané du jour d'achat.
Puis-je redistribuer ou construire des produits par-dessus ?
Oui — les données CFTC sont domaine public, sans licence. Nous ne restreignons pas ce que vous faites avec les octets. Nous demandons seulement de ne pas redistribuer notre ZIP schema-versionné tel quel gratuitement, car cela mine notre travail d'empaquetage ; construisez quelque chose par-dessus.
Quid des remboursements ?
Les clients UE/UK ont le droit standard de rétractation de 14 jours, sauf si le téléchargement a commencé. Après téléchargement, le produit n'est pas remboursable (biens numériques, exécution commencée). Hors de cela, contactez support@cot-reports.com pour tout problème.
Le schéma risque-t-il de casser mon pipeline ?
Pas sans préavis. Le `schemaVersion: "v1"` actuel dans `manifest.json` est un contrat : ajouter des colonnes reste en v1 (non-breaking). Renommer, supprimer ou réordonner des colonnes passe en v2 et est annoncé sur le changelog avant la mise en ligne. Fixez-vous sur la version du manifeste, construisez votre parseur une fois, et faites confiance au contrat.
Puis-je ouvrir les fichiers dans Excel ou Google Sheets ?
Oui — chaque CSV s'ouvre nativement dans Excel, Google Sheets, Numbers, LibreOffice Calc ou tout outil tableur. Les fichiers sont en UTF-8 simple avec séparateurs virgule et champs texte entre guillemets. Le plus gros CSV (cot-futures-only.csv) compte environ 280 000 lignes, bien sous la limite de 1M lignes/feuille d'Excel. Pour Python ou R, utilisez pandas.read_csv() / read.csv() — les types de colonnes sont déductibles.
Puis-je utiliser ces données pour backtester des stratégies basées sur la CFTC ?
Oui. L'archive inclut la série hebdomadaire complète des instantanés du mardi pour chaque marché, à travers les quatre familles de rapport CFTC. Legacy Futures Uniquement remonte à 1986 ; Désagrégé, TFF et Supplémentaire remontent à 2006. Vous obtenez chaque catégorie de trader (Non commerciaux, Commerciaux, Fonds gérés, Producteurs/Commerçants, Swap Dealers, Gestionnaires d’actifs, Fonds à effet de levier, Dealer, etc.) avec positions, variations et pourcentage d'open interest. Combinez avec des OHLCV quotidiens de votre fournisseur de prix pour des backtests complets.
Quelle est la taille du téléchargement et combien de temps cela prend-il ?
Le ZIP compressé fait environ 100 Mo. Décompressé, les 12 fichiers totalisent autour de 700 Mo — la majorité du volume est dans les NDJSON (chaque ligne est un objet JSON complet, plus verbeux que la ligne CSV équivalente). Sur une connexion 50 Mbps, le téléchargement prend ~15 secondes ; sur des connexions plus lentes, proportionnellement plus. Livré via une seule URL Storage signée — un téléchargement, un fichier.
Quelle est la différence entre les fichiers CSV et NDJSON ?
Données identiques dans deux formats. CSV est plat — séparé par virgules, une ligne par observation, lisible dans les tableurs et éditeurs, facile à charger dans pandas, R ou n'importe quelle base de données avec un importateur CSV. NDJSON (JSON délimité par sauts de ligne) est un objet JSON par ligne, idéal pour l'ingestion en streaming dans pandas (read_json(lines=True)), Spark, ClickHouse, BigQuery ou tout outil qui consomme JSON nativement. Choisissez le format adapté à votre chaîne d'outils ; vous n'avez pas besoin des deux.