한글날 공휴일 유래와 시작 쉬는 날 아니라고? 왜?
우리가 사용한느 컴퓨터는 모든 정보들이 0과 1로 이루어진 숫자로 해석됩니다. 다양한 언어로 이루어진 문자들을 어떻게 컴퓨터가 이해할 수 있도록 변화될 수 있을까요? 이는 인코딩이라는 과정을 통해서 변환되는데, 많이 사용되는 UTF 인코딩에 대해서 알아보겠습니다.
UTF는 전 세계 모든 문자를 하나의 표준으로 통일하여 컴퓨터가 처리할 수 있도록 만든 인코딩 방식입니다. 우리가 사용하는 한글, 영어, 중국어 등 다양한 언어의 문자를 하나의 코드로 표현하여 컴퓨터가 혼동 없이 처리할 수 있도록 해주는 것입니다.
UTF-8
바견 길이 인코딩은 문자에 따라 1~4바이트를 사용하여 효율적인 저장 공간 활용이 가능하며, ASCll이랑 호환되기에 기존 시스템과 연동이 용이합니다. 웹에서 가장 많이 사용되는 인코딩 방식입니다.
UTF-16
문자에 따라 2~4바이트를 사용하며, 자바에서 기본적으로 사용됩니다. UTF-8보다 저장 공간 효율은 좋지만 바이트 순서를 고려해야 합니다.
UTF-32
모든 문자를 4바이트로 고종하여 처리하며 간단하고 일관성이 있지만 불필요하게 많은 공간을 차지합니다.
추가로 한글 인코딩이 있으며 한글을 표현하기 위해 주로 사용되는 인코딩으로 앞선 UTF-8/ EUC-KR/ CP949가 있으며 각각 유니코드를 기반으로 하여 전세계에서 가장 많이 사용하는 UTF-8과 함께 확장 유닉스 코드로 한글과 영문을 함께 표현하는 인코딩인 EUC-KR.
마이크로소프트에서 사용하는 한글 완성형 인코딩으로 앞선 EUC-KR에서 표현하지 못한 문자를 표현하기 위해 만들어진 CP949가 있습니다.
글로벌 시대에 필수적으로 다양한 언어의 공유를 위해서는 하나의 표준이 필요하며 데이터 손실 방지를 위해서도 필요합니다. 웹 페이지를 개발할 때 올바른 인코딩을 설정하지 않으면 한글이 깨져 보이거나 다른 문제가 발생할 수 있기에 기본적으로라도 UTF-8 인코딩을 사용하는 것을 추천드립니다.
*AUTHY 설치 방법 및 필요한 이유까지 백업 비밀번호의 설정