추상 위키백과:소개
추상 위키백과는 무엇인가요?
추상 위키백과는 위키백과의 새로운 자매 프로젝트입니다.
위키백과의 비전은 모든 사람이 인류의 모든 지식의 총합에 접근할 수 있는 세상을 만드는 것입니다. 추상 위키백과는 위키백과 및 관련 프로젝트에 기여하는 자원봉사자 커뮤니티가 지식의 격차를 더욱 효과적으로 줄일 수 있도록 지원할 것입니다.
위키백과는 300개가 넘는 언어로 2,000만 개 이상의 주제에 관한 문서를 보유하고 있습니다. 그러나 이 중 단 하나의 언어도 이 2,000만 개 주제 전체에 대한 접근을 보장하지는 못합니다. 영어 위키백과에는 700만 개 이상의 문서가 있는 반면, 크로아티아어는 23만 개, 스와힐리어는 10만 개에 불과합니다. 해당 언어를 구사하지 못한다면, 그 지식은 쉽게 이용할 수 없습니다. 최근 인공 지능의 발전 덕분에 기계 번역이 크게 향상되었다고는 하지만, 여전히 많은 언어 쌍(Language pairs) 간에 신뢰할 수 있는 수준의 번역을 제공하는 단계에는 이르지 못했습니다.
추상 위키백과는 인공 지능에 의존하지 않고 이 문제를 해결합니다. 모든 단계는 인간의 제어 하에 유지되며, 자원봉사자들이 자유롭게 접근하고 편집할 수 있습니다. 환각(할루시네이션) 현상이나 원인을 알 수 없어 고칠 수 없는 오류는 발생하지 않습니다. 만약 잘못된 부분이 있다면 단 한 단계만으로 수정이 가능하며, 텍스트가 생성되는 모든 과정이 투명하게 공개됩니다. 이는 매번 확률적 모델에 의존해 케냐의 수도를 우연히 골라내는 방식이 아닙니다. 인간이 직접 큐레이션하고 소유하는 지식입니다.
추상 위키백과는 어떻게 작동하나요?
추상 위키백과의 문서들은 인간의 언어로부터 독립적인 표기법으로 저장됩니다. 추상 위키백과의 인터페이스는 자원봉사 기여자들이 이 언어 독립적 표기법을 생성하고 유지 관리할 수 있도록 지원합니다. 두 번째 단계에서는 이 표기법이 인간의 언어로 된 텍스트로 변환됩니다. 이러한 변환을 구현하는 데 필요한 단계들 역시 위키함수에서 자원봉사자 커뮤니티가 직접 생성하고 유지 관리합니다. 이 과정에서 위키데이터의 데이터를 활용해 인구 수, 출생일, 혹은 불규칙한 문법 형태 등을 조회할 수 있으며, 이 데이터들 또한 자원봉사자 커뮤니티가 위키데이터에 추가하고 유지 관리하고 있습니다.
단계별 가이드는 도움말:문서 만들기를 참조하세요.
한 가지 예시를 살펴보겠습니다. "나이지리아는 아프리카에서 인구가 가장 많은 국가이다."라는 문장은 추상 위키백과에서 다음과 같이 저장될 수 있습니다:
또는 이 식별자들에 영어 라벨을 적용하면 다음과 같이 표현됩니다:
이것은 위키함수에서의 함수 호출입니다. 선택한 언어에 따라 또 다른 함수가 호출됩니다. 영어의 경우 다음과 같은 함수 호출이 이루어집니다.
그리고 그 결과로 다음과 같은 영어 텍스트가 생성됩니다:
만약 독일어를 선택했다면 다른 함수가 호출되었을 것입니다:
그 결과로 다음과 같은 독일어 텍스트가 생성됩니다:
더 많은 언어가 적용된 예시는 여기에서 확인하실 수 있습니다.
추상 위키백과는 위키미디어 운동의 수많은 커뮤니티를 하나로 모으고 이들이 함께 협업할 수 있도록 지원합니다. 위키데이터의 기초 어휘 데이터와 다양한 주제에 관한 구조화된 데이터, 필요한 연산을 수행하는 위키함수의 함수들, 그리고 위키미디어 공용의 이미지와 지도가 모두 추상 위키백과에서 하나로 묶여 300개가 넘는 모든 언어판 위키백과에 제공됩니다.
추상 위키백과의 목표는 더 많은 지식을 더 많은 사람에게 더 많은 언어로 제공하는 것입니다. 또한 자원봉사 편집자들이 어떤 언어를 사용하든 관계없이 언어의 장벽을 넘어 더욱 효과적으로 협업할 수 있도록 돕는 것입니다. 지식의 내용이 개선되면 각 언어판 위키백과로 자동 전파되며, 오류는 더 빠르게 발견되어 효과적으로 수정될 것입니다. 아울러 언어 간 협업도 가능해집니다. 우리는 지식을 갈라놓고 있는 언어의 장벽을 허물고 있습니다.