제 일상 업무에는 macOS, Windows, Linux를 오가며 작업하는 것이 포함되는데, 이러한 시스템들을 오가며 작업할 때 가장 어려운 점 중 하나는 저장 공간 관리 문제입니다. 파일은 빠르게 늘어나고, 각 시스템에는 중복 파일이 쌓이기 마련입니다. 스크린샷이 기본 폴더마다 다르게 저장되어 있고, 같은 문서를 같은 기기에 여러 번 다운로드했으며, 클라우드 동기화를 통해 거의 동일한 파일들이 여러 개 존재합니다.

저는 주로 제 운영체제와 호환성이 좋은 정리 도구를 사용하는 편인데, 효과가 좋더라도 여러 기기에서 일관된 습관을 유지하기는 어렵습니다. 그래서 중복 파일을 찾아 제거해주는 dupeGuru라는 도구를 사용해보기로 했습니다. AllDup과 유사하게 작동합니다.하지만 이는 플랫폼에 관계없이 동작 방식이 변하지 않기 때문에 이상적입니다.
로압 스리유에스
dupeGuru는 두 파일이 "동일하다"고 어떻게 판단하나요?
중복 항목을 감지하는 매칭 로직은 검색을 중단했습니다.

내장된 파일 정리 도구 중 상당수는 파일 이름을 이용해 중복 파일을 찾기 때문에 많은 파일을 놓칩니다. dupeGuru 콘텐츠 기반 매칭 시스템입니다. 이 방식은 파일 이름을 사용하지 않고 파일 내용을 분석합니다. dupeGuru가 파일을 콘텐츠별로 정렬하는 것을 보고 제가 중복 파일의 수를 과소평가하고 있었다는 것을 깨달았습니다.
저는 dupeGuru를 사용할 때 모드를 거의 바꾸지 않고, 바꿀 때도 의도적으로 바꿉니다. 대부분의 문서, 압축 파일, 그리고 자잘한 파일들을 정리하기에는 기본 dupeGuru 버전이 충분합니다. 하지만 메타데이터 차이로 인해 중복된 오디오 파일이 숨겨져 있을 때는 음악 정리 버전을 사용하고, 이미지 크기를 조정하거나 압축할 때는 사진 정리 버전을 선호합니다. 따라서 일반적인 디스크 정리에는 기본 모드를 사용하고, 미디어 파일 정리처럼 특정 유형의 파일이 중복될 때만 모드를 전환하는 것이 좋습니다.
DupeGuru는 어느 정도 모호성을 허용하는 유사도 임계값을 사용합니다. 100% 유사도는 데이터가 완벽하게 동일한 파일을 나타내며, 비율이 낮을수록 파일 간의 일치도가 떨어집니다. 이미지의 경우 높은 유사도를 신뢰하지만, 문서의 경우에는 더 엄격한 기준을 적용합니다.
모든 것을 확인하는 것은 쓸모없는 결과를 얻는 가장 빠른 방법입니다.
결국 수표 내용을 예측 가능하게 만든 폴더 전략

dupeGuru를 처음 사용했을 때 얻은 결과는 매우 혼란스러웠습니다. 하지만 그 이유는 제가 도구를 사용하는 방식에 있었습니다. 단순히 전체 디렉토리를 지정하고 실행만 했던 것이죠. 이렇게 하면 보통 제가 검토할 시간이나 자신감이 없을 정도로 너무 많은 일치 항목이 나왔습니다. 도구 자체는 훌륭했지만, 잘못된 입력으로 인해 잘못된 결과가 나온 것입니다.
현재 저는 정리하고 싶은 폴더와 신뢰할 수 있는 폴더를 분리하는 방식을 사용하고 있습니다. 원본, 아카이브 또는 엄선된 컬렉션을 보관해야 하는 특정 폴더는 참조 폴더로 지정합니다. 이렇게 하면 중복 파일이 발견될 때 dupeGuru가 참조 폴더에 있는 파일을 삭제하라고 제안하지 않습니다.
저는 특정 디렉토리를 검사 대상에서 제외합니다. 시스템 폴더, 응용 프로그램 패키지, 패키지 관리자가 포함된 디렉토리들이 여기에 해당합니다. 이러한 위치를 제외함으로써 불필요한 파일들을 많이 줄일 수 있습니다. 또한 검사 범위를 좁히면 더 빠르고 정확한 결과를 얻을 수 있습니다. 어떤 파일을 삭제할지 고민하는 시간도 크게 줄어듭니다.
dupeGuru 검색 결과를 읽는 방법을 배우고, 그들과 직접 소통하지 마세요.
내가 주의 깊게 보는 열과 내가 거의 무시하는 열
처음에는 일치율에 많은 시간을 쏟았습니다. 하지만 시간이 지나면서 이것이 실수였을지도 모른다는 것을 깨달았습니다. 일치율은 유사성만 보여줄 뿐 중요도는 나타내지 않기 때문입니다. 더 중요한 요소는 크기, 위치, 그리고 특정 파일이 참조 폴더에 있는지 여부였습니다. 즉각적인 반응을 보이기보다는 표를 꼼꼼히 읽어보는 데 시간을 투자하니 삭제 작업이 더 정확해졌습니다.
결과를 크기 순으로 정렬하면 가장 많은 공간을 차지하는 중복 파일부터 처리할 수 있습니다. 또한 미디어 중심 스캔에서는 델타 값을 사용하여 파일의 실제 내용을 파악하고, 폴더 경로를 통해 일부 중복 파일이 존재하는 이유를 알아냅니다. 이 모든 정보는 의사 결정을 더 쉽게 내릴 수 있도록 맥락을 제공합니다.
하지만 진정한 혁신은 파일 미리보기 기능입니다. 파일을 직접 열어볼 수 있으니 일치하는 파일을 추측할 필요가 없죠. dupeGuru의 미리보기 기능이 모든 운영체제에서 완벽하게 작동하는 건 아니지만, 신뢰를 쌓는 데에는 아주 효과적입니다. 눈으로 직접 확인하니 안심하고 사용할 수 있고, 정리 작업도 훨씬 수월해집니다. 메인 저장 공간을 확보할 방법이 필요했습니다.이러한 명확성은 무엇을 버려야 할지 아는 데 도움이 됩니다.
dupeGuru는 모든 운영 체제에서 동일한 방식으로 사용할 수 있습니다.
이러한 일관성이 제가 드라이브를 청소하는 빈도에 어떤 영향을 미쳤을까요?

하지만 dupeGuru를 돋보이게 하는 것은 단순히 기능적인 측면을 넘어섭니다. 이 도구는 제가 사용하는 모든 플랫폼(Linux, Windows, macOS)에서 동일하게 작동합니다. 디자인, 스캔 과정, 결과 표가 모두 일관적이어서 다른 기기를 사용한다는 이유로 정리 작업을 미루는 일이 없습니다.
dupeGuru는 플랫폼에 관계없이 외장 드라이브에서도 동일한 방식으로 작동합니다. 동일한 속성 논리를 사용하여 스캔하고 동일한 감사 방식을 통해 결과를 검토할 수 있습니다. dupeGuru는 명령줄 인터페이스도 제공하는데, 반복적인 작업을 수행하거나 원격 세션에 참여해야 할 때 유용합니다. 하지만 일상적인 정리 작업에는 그래픽 사용자 인터페이스가 더 편리합니다.
수년간 수동으로 동기화하고 복사해 온 사진 라이브러리를 세 가지 플랫폼에 모두 분산시킨 후에야 dupeGuru의 멀티 플랫폼 기능을 제대로 활용할 수 있게 되었습니다. 마법 같은 해결책은 아니었지만, dupeGuru 덕분에 어떤 사진이 어디에 중복되어 있는지 명확하게 파악할 수 있었습니다.
장기간 사용은 무엇을 가르쳐줍니까?
대용량 스캔이 필요한 경우, DupeGuru는 가장 빠른 정리 도구는 아니며, 특히 용량이 매우 큰 드라이브에서 사용할 때는 다소 번거롭게 느껴질 수 있습니다. 따라서 작업을 더 작은 부분으로 나누는 것이 중요한 대안입니다. 처음에는 속도가 느려 보일 수 있지만, 결과 관리가 훨씬 쉬워진다는 장점이 있습니다.
음악과 이미지 설정을 과도하게 조정하면 때때로 흐릿하게 일치하는 경우가 발생하기 때문에 저는 그러한 조정을 피합니다. 유사도 임계값을 높이거나 기본 설정으로 되돌리면 이 문제가 해결됩니다. 하지만 이 프로그램의 가장 큰 장점은 플랫폼에 관계없이 일관된 성능을 제공한다는 점입니다. Czkawka와 같은 중복 제거 도구와 매우 유사합니다..










