한 줄로 마이그레이션
단계별 마이그레이션
1
chDB 설치
2
import 구문 변경
3
변경 없이 그대로 작동하는 항목
데이터 로딩
필터링
선택
GroupBy 및 집계
정렬
String 연산
DateTime 연산
I/O 연산
주요 차이점
1. 지연 평가
2. 반환 유형
3. inplace 매개변수 미지원
inplace=True를 지원하지 않습니다. 항상 반환값을 사용하십시오:
pandas:
4. DataStore 비교하기
to_pandas()를 사용하세요:
5. 행 순서
마이그레이션 패턴
패턴 1: 읽고 분석한 뒤 쓰기
패턴 2: pandas 작업용 DataFrame
패턴 3: 혼합 워크플로우
성능 비교
1,000만 행 기준 벤치마크
마이그레이션 문제 해결
문제: 작업이 실행되지 않음
- 해당 작업이 호환성 목록에 포함되어 있습니까?
- 먼저 pandas로 변환해 보십시오:
ds.to_df().operation()
문제: 결과가 다름
문제: 성능 저하
문제: 타입 불일치
점진적 마이그레이션 전략
1주 차: 호환성 테스트
2주차: 간단한 스크립트로 전환
- 대용량 파일을 읽는 스크립트
- 필터링과 집계를 수행하는 스크립트
- 사용자 정의 apply 함수를 사용하지 않는 스크립트
3주 차: 복잡한 경우 처리
4주차: 전체 마이그레이션
FAQ
pandas와 DataStore를 둘 다 사용할 수 있나요?
테스트가 여전히 통과하나요?
pandas로 변환하세요: