La migration en une seule ligne
Migration étape par étape
1
Installer chDB
2
Modifier l’import
3
Tester votre code
Exécutez votre code existant. La plupart des opérations fonctionnent sans modification :
4
Gérer les différences éventuelles
Certaines opérations se comportent différemment. Voir Principales différences ci-dessous.
Ce qui fonctionne tel quel
Chargement des données
Filtrage
Sélection
GroupBy et agrégation
Tri
Opérations sur les chaînes de caractères
Opérations sur DateTime
Opérations d’E/S
Principales différences
1. Évaluation différée
2. Types de retour
3. Aucun paramètre inplace
inplace=True. Utilisez toujours la valeur de retour :
pandas:
4. Comparer les DataStores
to_pandas() pour les comparer :
5. Ordre des lignes
Schémas de migration
Schéma 1 : lecture-analyse-écriture
Schéma 2 : DataFrame avec pandas
Schéma 3 : workflow mixte
Comparaison des performances
Benchmark sur 10 M de lignes
Dépannage de la migration
Problème : l’opération ne fonctionne pas
- L’opération figure-t-elle dans la liste de compatibilité ?
- Essayez d’abord de convertir en pandas :
ds.to_df().operation()
Problème : résultats différents
Problème : lenteurs
Problème : incompatibilités de types
Stratégie de migration progressive
Semaine 1 : tester la compatibilité
Semaine 2 : passez aux scripts simples
- lisent de gros fichiers
- effectuent du filtrage et de l’agrégation
- n’utilisent pas de fonctions apply personnalisées