ワンライナーでの移行
段階的な移行
1
chDB をインストール
2
インポートを変更
3
コードをテスト
既存のコードを実行します。ほとんどの操作はそのまま動作します。
4
相違点に対応
一部の操作は挙動が異なります。以下の主な違いを参照してください。
そのまま動作するもの
データの読み込み
フィルタリング
選択範囲
GroupBy と集計
ソート
文字列操作
DateTime の操作
I/O 操作
主な違い
1. 遅延評価
2. 戻り値の型
3. inplace パラメータはありません
inplace=True をサポートしていません。必ず戻り値を使用してください。
pandas:
4. DataStore の比較
to_pandas() を使用します。
5. 行の順序
移行パターン
パターン 1: 読み込み・分析・書き込み
パターン2: pandasで操作するDataFrame
パターン3: 混在ワークフロー
性能比較
1,000万行でのベンチマーク
移行のトラブルシューティング
問題: 操作が機能しない
- その操作は互換性リストに含まれていますか?
- まず pandas に変換してから試してください:
ds.to_df().operation()
問題: 結果が異なる
問題: パフォーマンスが低い
問題: 型の不一致
段階的移行戦略
第1週: 互換性をテスト
第2週: 単純なスクリプトを移行する
- 大きなファイルを読み込む
- フィルタリングと集約を行う
- カスタムの apply 関数を使用しない