La migration en une ligne
Migration pas à pas
1
Installer chDB
2
Modifier l’import
3
Tester votre code
Exécutez votre code existant. La plupart des opérations fonctionnent sans modification :4
Gérer les éventuelles différences
Quelques opérations se comportent différemment. Voir les principales différences ci-dessous.Ce qui fonctionne tel quel
Chargement des données
Filtrage
Sélection
GroupBy et agrégation
Tri
Opérations sur les chaînes
Opérations sur DateTime
Opérations d’E/S
Principales différences
1. Évaluation différée
2. Types de retour
3. Pas de paramètre inplace
inplace=True. Utilisez toujours la valeur renvoyée :
pandas:
4. Comparer des DataStores
to_pandas() pour les comparer :
5. Ordre des lignes
Stratégies de migration
Modèle 1 : lecture-analyse-écriture
Modèle 2 : DataFrame avec opérations pandas
Modèle 3 : workflow mixte
Comparaison des performances
Benchmark sur 10 M de lignes
Dépannage de la migration
Problème : l’opération ne fonctionne pas
- L’opération figure-t-elle dans la liste de compatibilité ?
- Essayez d’abord de convertir en DataFrame pandas :
ds.to_df().operation()
Problème : résultats différents
Problème : lenteurs
Problème : incompatibilités de types
Stratégie de migration progressive
Semaine 1 : Tester la compatibilité
Semaine 2 : Migrez d’abord les scripts simples
- Lisent de gros fichiers
- Effectuent du filtrage et de l’agrégation
- N’utilisent pas de fonctions apply personnalisées