Skip to content

Java ‐ File, Files

woojin.jang edited this page May 7, 2026 · 4 revisions

File

  • 자바에서 파일 또는 디렉터리를 다룰 때는 File, Files, Path 클래스를 사용하면 된다.

Files

  • Files, PathFile를 대체하기 위해 등장했다.

Files의 특징

  • 성능과 편의성이 모두 개선되었다.
  • File은 과거 호환을 유지하기 위헤 남겨둔 기능이다.
  • 수많은 유틸리티 기능이 있다.

파일 복사 최적화

  • Files.copy() → 자바에 파일 데이터를 불러오지 않고 운영체제의 파일 복사 기능을 사용한다.
  • 파일 전체를 메모리로 불러와 새로운 파일을 생성해야하는 중간 과정이 생략된다.

📚File Copy

  • 자바 어플리케이션으로 데이터를 일일이 퍼올리는 것보다 운영체제(Kernel Scope) 수준에서 직접 처리하도록 명령하는 것이 훨씬 효율적이다.

1. 데이터 복사 비용의 절감(Zero-Copy)

  • 일반적인 자바 I/O 방식(FileInputStream 등)은 데이터가 전달될 때 여러 번의 복사 과정을 거친다.
  • Disk → Kernel Buffer : 하드디스크에서 커널 메모리로 복사
  • Kernel Buffer → Java Application : 커널에서 자바 애플리케이션의 힙 메모리로 다시 복사
  • 이 과정에서 CPU 자원이 소모되고, 자바 힙 메모리에 데이터가 쌓이면서 GC 부하가 커진다. 반면 운영체제에 맡기는 방식은 데이터를 자바 영역으로 가져오지 않고 커널 안에서 바로 네트워크 전송이나 다른 파일로 쏴버린다.

2. 컨텍스트 스위칭(Context Switching) 감소

  • 자바가 데이터를 직접 제어하려면 Application - Kernel을 왔다 갔다 해야 한다. 이 과정이 컨텍스트 스위칭이며 이 전환 비용은 상당하다.
  • 운영체제에 권한을 위임하면 이런 컨텍스트 스위칭 횟수가 획기적으로 줄면서 레이턴시가 낮아진다.

3. 커널 캐시(Page Cache)의 효율적 활용

  • 운영체제는 자주 쓰이는 파일 데이터를 메모리에 미리 올려둔다.(=Page Cache)
  • 자바 애플리케이션이 직접 데이터를 관리하려고 들면 OS의 최적화 기능을 제대로 활용하지 못하거나, 메모리만 이중으로 낭비(OS 캐시 + Java Application Heap)하게 될 가능성이 크다.

📖 Java🔥

📖 Kotlin⭐

📖 Coroutine📎

📖 Spring🔥

📖 Spring Security⭐

📖 Spring Security OAuth2⭐

📖 Spring Batch📎

📖 Database🔥

📖 MySQL🔥

📖 Redis⭐

📖 JPA⭐

📖 QueryDsl📎

📖 MSA⭐

📖 Kafka⭐

📖 Apache Flink📎

  • [Apache Flink - Apache Flink Architecture]
  • [Apache Flink - Stream Processing]
  • [Apache Flink - Data Stream API & Window]
  • [Apache Flink - State Management]

📖 HTTP🔥

📖 AWS⭐

📖 Docker⭐

📖 Kubernetes⭐

📖 Github Actions📎

📖 Jenkins📎

📖 Nginx⭐

📖 Monitoring📎

📖 Test(feat. Load Testing)📎

📖 Test(feat. Java)⭐

📖 Spring AI📎

📖 gRPC📎

  • [gRPC - Writing .proto Files with Protocol Buffers]
  • [gRPC - Various Communication Patterns in gRPC]
  • [gRPC - gRPC Optimization Techniques and Advanced Features]

📖 Spring Cloud Microservice Application📎

📖 TDD(Test-Driven-Development)⭐

📖 PostgreSQL📎

  • [PostgreSQL - Docker만을 사용하는 경량화된 환경 구성 방법]
  • [PostgreSQL - PostgreSQL에서 제공하는 데이터 타입]
  • [PostgreSQL - PostgreSQI의 JSONB, 역인덱싱과 활용 방법]
  • [PostgreSQL - 데이터베이스 성능을 위한 최적화 패턴 및 전략]
  • [PostgreSQL - 트랜잭션과 ACID, Isolation 수준별 차이]
  • [PostgreSQL - Database Lock 교착상태와 읽기/쓰기 성능을 보장하는 MVCC 모델]
  • [PostgreSQL - pgvector와 벡터 저장, 유사도 검색 패턴 개념]
  • [PostgreSQL - 벡터 인덱스 최적화와 벡터 검색과 전문 검색 결합 패턴]
  • [PostgreSQL - PostgreSQL 플러그인]
  • [PostgreSQL - PostGIS - 공간 쿼리와 GIST 인덱스, 지리 타입과 공간 쿼리를 위한 타입과 기본 함수]
  • [PostgreSQL - pg_search - 검색 엔진 없이 텍스트 검색 구현과 주의사항]
  • [PostgreSQL - 단일 인스턴스 한계를 극복하는 분산 패턴과 스케줄링, 분산 환경 구축 방법]
  • [PostgreSQL - Citus - 분산 테이블과 분산 쿼리를 위한 Extension과 데이터 분산 처리]
  • [PostgreSQL - pg_cron - PostgreSQL로 구성하는 CronJob]
  • [PostgreSQL - 스케줄러 + 분산 처리를 동시에 도입하는 주기적 집계 쿼리 패턴]

📖 Workflow-Driven Techniques for Large-Scale Traffic Processing📎

  • [Workflow-Driven Techniques for Large-Scale Traffic Processing - Kafka + Debezium을 활용한 CDC 패턴 설계]
  • [Workflow-Driven Techniques for Large-Scale Traffic Processing - Temporal을 활용한 워크플로우 패턴]
  • [Workflow-Driven Techniques for Large-Scale Traffic Processing - Docker와 경량 이미지를 활용한 환경 구축 방법]
  • [Workflow-Driven Techniques for Large-Scale Traffic Processing - Kafka에서의 메시지 Delivery Guarantee]
  • [Workflow-Driven Techniques for Large-Scale Traffic Processing - 실시간 동기화의 핵심 CDC]
  • [Workflow-Driven Techniques for Large-Scale Traffic Processing - MySQL Binary Log 기반의 CDC]
  • [Workflow-Driven Techniques for Large-Scale Traffic Processing - Binary Log 기반의 CDC 구현 플랫폼 Debezium이란?]
  • [Workflow-Driven Techniques for Large-Scale Traffic Processing - Debezium Architecture]
  • [Workflow-Driven Techniques for Large-Scale Traffic Processing - Debezium Architecture Best Practice와 주의사항]

📖 Reactive Programming📎

📖 ElasticSearch📎

📖 Design Pattern📎

📖 Clean Spring📎

  • [Real MySQL 8.0 - 인덱스]
  • [Real MySQL 8.0 - 실행 계획]
  • [Real MySQL 8.0 - 아키텍처]
  • [Real MySQL 8.0 - 트랜잭션과 잠금]
  • [도메인 주도 설계의 사실과 오해 - DDD 요약]
  • [도메인 주도 설계의 사실과 오해 - Preface, Entity & VO]
  • [도메인 주도 설계의 사실과 오해 - 연관 관계와 애그리거트]
  • [도메인 주도 설계의 사실과 오해 - 애그리거트 구현]
  • [도메인 주도 설계의 사실과 오해 - 레포지토리와 기타 패턴]
  • [도메인 주도 설계의 사실과 오해 - 통찰력을 향한 리팩터링]
  • [도메인 주도 설계의 사실과 오해 - 유연한 설계를 향한 리팩터링]
  • [도메인 주도 설계의 사실과 오해 - 모델의 경계를 긋고, 핵심에 집중하라]

Clone this wiki locally