애플리케이션 가이드

고대 언어 해독의 AI

AI는 기호에서 통계적 패턴을 찾아내고, 누락된 문자를 복원하고, 번역을 제안함으로써 학자들이 잃어버린 문자와 손상된 텍스트를 읽을 수 있도록 도와줍니다.

2분 읽기마지막 업데이트

개요

It turns decipherment from decades of manual guesswork into a faster, data-driven collaboration.

심층 분석

고대 언어를 해독한다는 것은 그 기호가 소리와 의미에 어떻게 매핑되는지 알아내는 것을 의미하며, 종종 살아남은 텍스트가 거의 없고 이중 언어 키도 없습니다. 기계 학습은 여러 가지 방법으로 지원합니다. 신경망은 반복되는 기호를 클러스터링하여 가능한 단어, 접미사 및 문법을 식별할 수 있습니다. 텍스트가 깨지거나 마모되면 말뭉치에 대해 훈련된 시퀀스 모델은 전화기가 단어를 자동 완성하는 것처럼 가장 가능성이 높은 누락 문자를 예측할 수 있습니다. 수만 개의 그리스 비문에 대해 훈련된 DeepMind의 Ithaca 모델은 손상된 텍스트를 복원하고 비문이 언제 언제 기록되었는지 추정하며 역사가에게 평가할 순위가 높은 제안을 제공합니다. 다른 프로젝트에서는 통계적 정렬을 사용하여 선형 B 및 Ugaritic과 같은 알려지지 않은 스크립트를 알려진 관련 언어에 연결하고 번역을 가속화했습니다.

기술적 통찰력

모델은 스크립트를 토큰의 시퀀스로 처리하고 어떤 기호가 다른 기호 뒤에 올 확률을 학습합니다. 복원을 위해 변환기 또는 순환 네트워크는 손상되지 않은 구절에 대해 훈련된 다음 가려진 간격을 채우도록 요청되어 순위가 매겨진 후보 문자를 신뢰도 점수와 함께 출력합니다. 교차 언어 정렬은 알려지지 않은 언어의 기호 패턴을 가정된 친척의 알려진 구조에 매핑하여 매핑이 실제 단어를 얼마나 잘 생성하는지 점수를 매기는 방식으로 작동합니다.

전략적 영향

빌드 선택

애플리케이션 수준 설계는 AI가 실제 결과를 개선하는지 여부를 결정합니다.

팀과 워크플로우

훌륭한 워크플로우 통합은 사용자가 신뢰할 수 있는 생산성 향상을 가져옵니다.

위험과 안전

범위가 적절한 사용 사례는 변경 피로도와 구현 위험을 줄여줍니다.

고대 언어 해독에 있어서 AI의 미래

가장 어려운 남은 목표는 Indus Valley 스크립트 및 선형 A와 같이 작은 말뭉치와 알려진 친척이 없는 해독되지 않은 스크립트입니다. 여기서 데이터 부족으로 인해 통계가 증명할 수 있는 것이 제한됩니다. 미래 시스템은 언어 모델과 이미지 분석을 결합하여 사진에서 직접 침식된 정제와 봉인을 읽을 것입니다. 연구원들은 AI가 대체가 아닌 강력한 보조자로 남을 것이라고 강조하며, 인간 비문가는 역사와 맥락에 대해 테스트해야 한다는 가설을 생성합니다.

실제 구현

DeepMind의 Ithaca 모델은 손상된 고대 그리스 비문에서 누락된 단어를 복원하고 날짜와 원산지를 추정하여 함께 사용하면 역사가의 정확성을 높입니다.

알려진 미케네 그리스어에 대한 음성 및 어휘 매핑을 테스트하기 위해 선형 B 및 관련 선형 A에 기계 학습이 적용되었습니다.

우가리트어를 가까운 친척인 히브리어와 자동으로 정렬하여 번역하는 데 통계적 해독 방법이 사용되었습니다.

연구원들은 AI를 사용하여 단편적인 설형 문자판을 재구성하고 읽고 아카드어와 수메르어 텍스트의 깨진 기호를 예측합니다.

위험 및 가드레일

손상된 프로세스를 자동화하면 기존 문제가 증폭될 수 있습니다.

팀은 필요한 인간 판단을 과도하게 자동화하고 제거할 수 있습니다.

출력을 지속적으로 평가하지 않으면 품질이 달라질 수 있습니다.

구현 로드맵

1

현재 워크플로를 매핑하고 마찰이 가장 큰 단계를 식별합니다.

2

완전 자동화 전에 휴먼 체크포인트를 정의하세요.

3

프롬프트, 에스컬레이션 경로, 품질 표준에 대해 사용자를 교육합니다.

4

작업 수준 결과를 추적하여 지속적인 가치를 확인하세요.

계속 탐색하세요

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the AI in Ancient Language Decipherment quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

퀴즈 시작

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

자주 묻는 질문

What is AI in Ancient Language Decipherment?

AI는 기호에서 통계적 패턴을 찾아내고, 누락된 문자를 복원하고, 번역을 제안함으로써 학자들이 잃어버린 문자와 손상된 텍스트를 읽을 수 있도록 도와줍니다. 수십 년간의 수동 추측이 아닌 더 빠른 데이터 기반 협업으로 전환됩니다.

DeepMind의 Ithaca 모델은 고대 그리스 비문에 대해 어떤 역할을 합니까?

이타카는 손상된 구절을 복원하고 언제 어디서 쓰여졌는지 예측하여 역사가들을 돕기 위해 수만 개의 그리스 비문에 대한 훈련을 받았습니다.

고대 텍스트가 깨지거나 낡았을 때 시퀀스 모델이 어떻게 도움이 됩니까?

손상되지 않은 텍스트에 대해 학습된 모델은 자동 완성과 유사하게 가능성 있는 문자를 예측하여 가려진 공백을 채우고 순위가 매겨진 후보를 제공합니다.

Linear A 및 Indus Valley 스크립트와 같은 스크립트를 AI가 해독하기 어려운 이유는 무엇입니까?

통계적 방법에는 데이터가 필요하며 이상적으로는 알려진 친척이 필요합니다. 작은 말뭉치와 고립된 스크립트는 해독을 확인하기에는 신호가 너무 적습니다.

해독의 맥락에서 언어 간 정렬이란 무엇입니까?

연구자들은 미지의 언어를 가정된 친척에 매핑하고 실제 단어가 나오는지 여부를 평가함으로써 우가리트어와 히브리어에서와 마찬가지로 관계를 테스트할 수 있습니다.

이러한 모델은 일반적으로 내부적으로 스크립트를 어떻게 표현합니까?

스크립트는 텍스트 시퀀스처럼 처리됩니다. 모델은 어떤 기호가 어떤 기호를 따르는 경향이 있는지 학습하여 복원 및 패턴 발견을 가능하게 합니다.