기본 한영·영한 대응 데이터
단어, 짧은 구, 실용 문장처럼 한국어와 영어를 서로 대응해 검색할 수 있는 기본 데이터입니다. 한 표현에 하나의 대응만 있는 경우도 있고, 여러 뜻이나 번역 후보가 함께 존재하는 경우도 있습니다.
Data & Editorial Principles
X-DIC은 한영·영한 검색 결과를 하나의 절대적인 정답으로 고정하기보다, 데이터의 성격을 구분하고 여러 대응 표현과 문맥을 비교할 수 있게 하는 것을 중요하게 생각합니다. 이 페이지에서는 검색 데이터가 어떤 역할로 나뉘고, 어떤 항목을 채택하거나 보류하며, 오류를 어떻게 보완하는지 기본 원칙을 설명합니다.
01 · Data Types
X-DIC 검색 화면에 보이는 모든 정보가 같은 종류의 데이터는 아닙니다. 기본 대응 데이터, 전문용어, 병렬 문장과 검색 규칙은 서로 다른 목적을 가지고 있으며, 화면에서도 가능한 한 그 역할을 구분해 보여주는 방향을 유지합니다.
단어, 짧은 구, 실용 문장처럼 한국어와 영어를 서로 대응해 검색할 수 있는 기본 데이터입니다. 한 표현에 하나의 대응만 있는 경우도 있고, 여러 뜻이나 번역 후보가 함께 존재하는 경우도 있습니다.
의학, 기계·전기·전자, 무역·경제, 컴퓨터 등 분야별 전문용어를 한영·영한으로 탐색할 수 있도록 구성합니다. 같은 용어라도 분야와 문맥에 따라 번역이 달라질 수 있음을 전제로 합니다.
한국어와 영어 문장을 한 쌍으로 보면서 실제 문장 안에서 표현이 어떻게 사용되는지 비교할 수 있도록 하는 데이터입니다. 단어 뜻만으로 판단하기 어려운 경우에 문맥을 확인하는 자료가 됩니다.
여러 문장에서 반복해서 사용할 수 있고 문맥 의존성이 낮은 짧은 구나 문형은 검색·번역 규칙으로 별도 관리할 수 있습니다. 문맥에 따라 뜻이 크게 달라지는 표현은 자동 치환 규칙으로 무리하게 고정하지 않습니다.
02 · One-to-one & One-to-many
특정 문맥에서 한 표현과 한 번역이 안정적으로 대응하면 간단하게 한 쌍으로 보여줄 수 있습니다.
하나의 표현에 가까운 뜻이 여러 개 있거나 문맥에 따라 번역이 달라질 때는 하나를 강제로 선택하기보다 여러 대응을 함께 보존할 수 있습니다.
사전 검색에서는 “가장 짧은 답 하나”보다 사용자가 문맥에 맞는 표현을 선택할 수 있도록 정보를 충분히 남기는 것이 더 유용할 수 있습니다.
03 · Search Result Labels
현재 검색어와 관련성이 높은 병렬 문장 또는 검색 데이터 가운데 사용자에게 참고 가치가 높은 문장을 별도 블록으로 보여주는 영역입니다. 검색어 전체와 완전히 같은 문장이라는 뜻은 아닙니다.
검색어에 포함된 단어·짧은 구와 직접 대응하는 한영·영한 정보를 간단히 보여주는 영역입니다. 하나의 표현에 여러 대응어가 있으면 함께 제시될 수 있습니다.
검색어 전체 또는 핵심 단어와 관련된 데이터베이스 결과입니다. 검색어와 완전히 동일한 문장뿐 아니라 부분적으로 연결되는 병렬 데이터가 함께 포함될 수 있습니다.
현재 검색 결과와 직접 연결되는 전문용어·병렬 예문 등 X-DIC 내부 탐색 정보를 한곳에서 비교할 수 있도록 정리한 보조 영역입니다.
04 · Editorial Checks
한국어와 영어가 같은 핵심 의미를 전달하는지 먼저 확인합니다. 주어, 목적어, 긍정·부정, 의문문 여부가 서로 어긋나면 그대로 채택하지 않습니다.
확실한 맞춤법·띄어쓰기·철자 오류와 기초 문법을 점검합니다. 의미가 분명한 경우에는 짧고 자연스러운 병렬 문장으로 정리할 수 있습니다.
특정 인물·지역·브랜드·숫자·날짜·상황에 지나치게 묶인 문장은 범용 데이터나 자동 규칙으로 일반화하지 않습니다. 반복 활용이 가능한지 함께 봅니다.
업로드용 데이터는 정제 후 중복 여부와 문장 길이를 다시 확인합니다. 같은 데이터를 여러 결과 파일로 중복 업로드하지 않도록 구분합니다.
편집의 기본 방향: 뜻을 과감하게 “추측해서 채우는 것”보다, 의미 대응과 자연스러움에 확신이 부족한 데이터는 보류하고 추가 확인하는 쪽을 우선합니다.
05 · Hold / Review
원본에 포함되어 있다는 이유만으로 모든 문장을 바로 검색 데이터에 반영하지 않습니다. 아래와 같은 경우에는 보류하거나 별도 검토 대상으로 분리할 수 있습니다.
한국어와 영어의 핵심 의미가 정확히 대응하지 않는 경우
영어 문장이 불완전하거나 문법·자연스러움을 더 확인해야 하는 경우
주어·시제·긍정/부정·의문문 등 문장 구조가 서로 어긋나는 경우
고유명사·브랜드·국가·지역·숫자·날짜 등에 의존해 범용성이 낮은 경우
거래·기술·업무 등 특정 전문 문맥에 지나치게 의존하는 경우
의료·법률·정치·폭력·차별 등 별도 검토가 필요한 민감하거나 고위험 문맥인 경우
문맥이 부족해 하나의 번역으로 확정하기 어려운 경우
06 · Reusable Phrases & Rules
데이터베이스에 검색 자료로 남겨두는 것과 자동 번역 규칙으로 등록하는 것은 다릅니다. 자동 규칙은 다른 문장에도 영향을 줄 수 있으므로 재사용성과 문맥 독립성을 더 엄격하게 봅니다.
여러 문장에서 반복해 사용할 수 있는 구를 우선하며, 한 문장 전체를 그대로 PHRASE로 고정하는 방식은 가급적 피합니다.
한 표현의 번역이 특정 상황에서만 성립한다면 자동 규칙보다 일반 검색 데이터나 예문으로 남기는 편을 우선합니다.
가까운 한국어 대응이 둘 이상이면 하나를 억지로 버리기보다 여러 대응을 함께 보존하여 검색 시 비교할 수 있도록 합니다.
검색 엔진이 별도 문형 처리로 해결하는 표현을 다시 구문 규칙에 중복 등록하지 않도록 점검합니다. 불필요한 겹침은 예기치 않은 번역 충돌을 만들 수 있기 때문입니다.
예를 들어 다의성이 크거나 목적어·격식·담화 문맥에 따라 뜻이 달라지는 표현은 자동 PHRASE로 단일 치환하기보다 기본 검색 데이터로 보존하여 사용자가 여러 뜻을 비교하도록 하는 편이 더 안전할 수 있습니다.
07 · Data Lifecycle
기존 한영·영한 원문, 전문용어, 병렬 문장과 새 후보를 수집합니다.
의미 대응, 문법, 재사용성, 문맥, 길이와 중복을 보수적으로 확인합니다.
고신뢰 데이터는 업로드·규칙 후보로 분리하고, 확신하기 어려운 항목은 보류합니다.
데이터베이스 또는 검색 규칙에 반영해 실제 한영·영한 검색에서 사용합니다.
이전 검색 문장을 다시 테스트하고, 새 수정이 기존 결과를 해치지 않는지 반복 확인합니다.
08 · Accuracy & Limitations
X-DIC은 다양한 출처와 형태의 한영·영한 데이터를 검색·정리하는 서비스이므로, 모든 결과가 동일한 검수 수준이나 동일한 목적을 가진다고 보장하지 않습니다.
같은 단어와 문장도 문맥·분야·시제·화자 관계에 따라 번역이 달라질 수 있습니다. 중요한 문서나 전문 분야에서는 X-DIC 결과만으로 판단하지 말고 공식 자료나 해당 분야 전문가의 확인과 함께 사용해 주세요.
오류 또는 어색한 대응이 확인되면 데이터를 수정하거나 검색 규칙을 조정할 수 있으며, 새 수정이 기존 검색 품질을 해치지 않는지 회귀 테스트를 통해 반복 확인합니다.
데이터가 많더라도 문맥과 의미가 맞지 않으면 좋은 사전이 되기 어렵습니다. X-DIC은 검색 가능한 데이터의 범위를 넓히는 동시에, 사용자가 결과의 성격을 이해하고 여러 대응 표현을 비교할 수 있도록 검색 화면과 콘텐츠 허브를 계속 정리합니다.