inflearn logo
강의

강의

N
챌린지

챌린지

멘토링

멘토링

N
클립

클립

로드맵

로드맵

지식공유

모르면 야근하는 문자 인코딩 완전 정복

엔디안과 BOM

utf-8과 리틀 빅 엔디안은 관계없나요?

해결된 질문

146

김호균

작성한 질문수 4

0

utf-8에서 맨 앞에 1의 개수를 확인하고 이 데이터는 몇 바이트짜리구나. 라고 알 수 있다고 하셨잖아요.
그럼 빅엔디안에서는 시작하는 바이트의 값을 보고 확인 할 수 있는데, 리틀엔디안에서는 어디가 시작하는 바이트인지 명확하지 않게 되는거 같아요.
내가 사용하는 시스템(윈도우, 리눅스)?에 따라 내부적을 알아서 작동하는건가요?
10으로 시작하지 않는 바이트를 찾아서 이게 '시작바이트구나' 하고 여기서부터 거꾸로 읽어들이는 식인가요?

java utf-8 endian

답변 2

0

널널한 개발자

인프런 AI 답변을 참고하시면 되겠습니다. 😄

0

인프런 AI 인턴

안녕하세요, 인프런 AI 인턴입니다.

김호균님, UTF-8 인코딩과 엔디안(Endian)은 서로 다른 개념으로, UTF-8은 바이트 순서에 의존하지 않는 문자 인코딩 방식입니다. UTF-8은 가변 길이 인코딩 방식으로, 각 문자에 대해 첫 번째 바이트의 패턴을 통해 바이트 길이를 파악할 수 있습니다. 예를 들어, UTF-8에서 1바이트 문자는 0xxx xxxx 형태를 가지며, 다바이트 문자일수록 앞자리 1의 개수가 늘어납니다.

엔디안(Endian)은 주로 숫자 데이터를 저장하는 방식에서 사용하는 개념으로, 데이터의 바이트 순서에 영향을 미칩니다. 빅 엔디안은 가장 중요한 바이트를 앞에 두고, 리틀 엔디안은 가장 중요한 바이트를 뒤에 두는 방식입니다. 숫자 데이터 저장 시에 문제가 되는 것이지, UTF-8에서는 바이트의 순서를 따로 변경할 필요가 없습니다.

즉, UTF-8 인코딩에서는 특정한 바이트의 위치가 아닌 바이트의 패턴으로 문자의 시작을 판단하기 때문에, 엔디안 방식이 달라도 그런 식으로 처리할 필요가 없습니다.

추가로, 영어와 같은 아스키(ASCII) 문자는 UTF-8에서도 그대로 유지되며, 엔디안과 상관없이 해석이 가능합니다. 시스템(윈도우, 리눅스 등)도 UTF-8을 동일하게 처리하게 설계되어 있습니다.

관련된 더 자세한 설명과 예시는 다음 글을 참고하시면 도움이 될 것입니다:
- “무엇이 UTF-8을 대체할 수 없는가”

저는 질문자님의 이해를 돕고자 지식공유자님의 기존 답변을 참고하여 유사한 답변 링크를 추천해드리고 있습니다.
현재 베타 기능으로 답변이 만족스럽지 않을 수 있는 점 양해 부탁드립니다. 🙏
추가적으로 궁금한 점이 있으시면, 이어서 질문해 주세요. 곧 지식공유자께서 답변해 주실 것입니다.

AWS 배포 성능테스트

0

23

1

조건 반복문 질문: for 문 ?

0

33

0

run() 메서드 안에 지역변수 sum을 사용한 이유

0

34

0

7강 보고 있는데요.. 글자가 너무 작아요

0

26

1

무한 depth 구현 중 CommentPath 관련 질문

0

38

1

헥사고날 아키텍처와 DDD를 적용할 때, 화면에 강하게 연관된 조회 데이터를 어떻게 다루는 게 좋은지 궁금합니다.

0

54

2

정처기 26-2회. 9번 질문드립니다!

0

55

1

이론 보면서 질문이 있습니다.

0

62

2

정보처리기사 실기 26년 2회 SRT 스케줄링 문제 단위 질문

0

64

2

유튜브(정보처리기사 실기 | 26년 2회 기출문제 코드 해설)

0

80

2

262 정처기 실기 C언어코딩

0

34

1

정보처리기사 262 실기 Hash(해시) 질문

0

66

2

static 변수 질문입니다.

0

48

2

Request DTO에서 Entity를 생성할 때 의존성 방향을 반대로 하면 어떨까요?

0

66

2

파이썬 4강 질문입니다.

0

60

2

강의 화면이 안나와요

0

38

0

모의고사 1회 3번문제

0

77

3

41강 30:10

0

55

2

이론 공부법 질문 있습니다.

0

80

2

중급 과정 학습 중 복습과 진도 진행의 우선순위에 대해 질문드립니다

0

42

1

writeUTF 메서드로 생성된 파일 읽기

0

82

2

코글 인코딩이 뭔가요?

0

105

2

질문입니다.

0

73

2

Modified UTF-8에서 문자열의 길이 제한이 있나요?

0

122

1