- 배치와 서버리스는 always-on 비용 0을 공유하지만 용도가 정반대다 — 대량 일괄 vs 간헐 개별 요청.
- 배치 처리량 레버는 InstanceCount(병렬) · SplitType(분할) · BatchStrategy/MaxPayload/MaxConcurrentTransforms(미니배치).
- 입력이 분할 가능해야 인스턴스를 늘린 효과가 난다. 단일 대용량 파일은 아무리 늘려도 안 빨라진다.
- 예측을 원본 ID와 매칭하려면
input_filter/output_filter/join_source를 쓴다.
- 서버리스는
MemorySize + MaxConcurrency만 지정. 콜드 스타트는 Provisioned Concurrency로 완화(상시 비용 발생).
동기 엔드포인트의 반대편에 있는 두 가지, 배치 변환과 서버리스 추론을 깊이 판다. 먼저 배치 변환은 S3의 대량 입력을 읽어 일괄 추론하고 결과를 S3에 쓴다. 처리량을 높이는 레버는 세 가지다.
- InstanceCount: 인스턴스를 늘리면 데이터가 분산되어 병렬 처리