Base de Informações Fonéticas e Léxico (PHOIBLE)
Pontos principais
- O PHOIBLE compila inventários fonológicos de diversas línguas a partir de fontes primárias e terciárias.
- A versão 2.0 (2019) abrange mais de 2.100 línguas e 3.000 inventários.
- Utiliza a codificação Unicode para representação consistente de caracteres.
- Integra-se ao projeto Cross-Linguistic Linked Data (CLLD) via formatos CLDF.
O PHOIBLE (acrônimo de Phonetics Information Base and Lexicon) é um banco de dados linguísticos especializado na compilação de inventários fonológicos. A plataforma agrega dados provenientes de documentos primários e bases de dados terciárias, consolidando-os em um único repositório pesquisável para facilitar o estudo comparativo de sons em diferentes línguas.
A base de dados é editada por Steven Moran, professor assistente do Instituto de Biologia da Universidade de Neuchâtel, e Daniel McCloy, pesquisador do Instituto de Ciências do Aprendizado e do Cérebro da Universidade de Washington.
Princípios e Metodologia
Diferente de outras bases de dados que impõem um sistema único de descrição linguística, o PHOIBLE busca manter a fidelidade aos diversos métodos de descrição encontrados nos documentos de origem. Essas variações são tratadas como "doculectos". Para garantir a interoperabilidade e a precisão técnica, todos os dados de caracteres são codificados de acordo com a API Unicode.
Os dados disponibilizados pelo PHOIBLE são publicados sob a licença Creative Commons Attribution-ShareAlike 3.0 (CC BY-SA 3.0), permitindo o uso e a redistribuição do conteúdo desde que seja atribuída a autoria e mantida a mesma licença.
Organização e Estrutura dos Dados

A interface do website segue um modelo similar ao de outros projetos de referência, como o Glottolog, WALS e APiCS. Desde o lançamento da versão 2.0 em 2019, o PHOIBLE integra seus dados ao conjunto de dados Cross-Linguistic Data Formats (CLDF) do projeto Cross-Linguistic Linked Data (CLLD).
Classificação e Navegação
As línguas no banco de dados são organizadas por:
- Família linguística;
- Coordenadas geográficas;
- Regiões mundiais (África, Américas do Norte e do Sul, Austrália, Eurásia e Papunésia).
As páginas individuais de cada língua fornecem informações geográficas provenientes do Glottolog, incluindo o glottocode da língua e o código ISO 639-3 (vinculado ao SIL). Cada entrada de língua pode conter um ou mais inventários de fonemas, acompanhados de seus respectivos registros bibliográficos. A existência de múltiplas entradas para uma mesma língua ocorre quando fontes diferentes divergem quanto ao número ou à identidade dos fonemas presentes.
Recursos Fonológicos e Traços Distintivos
Além dos inventários de fonemas, o PHOIBLE inclui dados de traços distintivos para cada fonema. Este sistema é baseado, em termos gerais, na obra Introductory Phonology de Bruce Hayes, com adições provenientes da abordagem de laringe total de Moisik e Esling (The 'whole larynx' approach to laryngeal features). Esse sistema de traços é dinâmico e pode ser ajustado à medida que novas línguas são incorporadas à base.
Uma parte significativa dos dados do PHOIBLE, abrangendo 451 línguas, provém do UCLA Phonological Segment Inventory Database (UPSID), cujo autor, Ian Maddieson, também contribuiu para o capítulo de fonologia do WALS.
Estatísticas da Versão 2.0
A versão 2.0, lançada em 2019, registrou a seguinte abrangência:
| Categoria | Quantidade |
|---|---|
| Inventários | 3.020 |
| Tipos de Segmentos | 3.183 |
| Línguas Distintas | 2.186 |
Perguntas frequentes
O que é o PHOIBLE?
O PHOIBLE é um banco de dados linguísticos que reúne inventários fonológicos de diversas línguas do mundo, permitindo que pesquisadores consultem quais sons (segmentos) são utilizados em cada idioma.
Como o PHOIBLE lida com descrições divergentes de uma mesma língua?
O PHOIBLE não impõe um sistema único; ele registra a informação como 'doculectos', permitindo a existência de múltiplas entradas baseadas em diferentes fontes bibliográficas que podem divergir sobre a composição fonêmica da língua.
Quais são as fontes de dados do PHOIBLE?
Os dados provêm de documentos primários, bases de dados terciárias e, especificamente, um subconjunto de 451 línguas originárias do UCLA Phonological Segment Inventory Database (UPSID).
Qual a licença de uso dos dados do PHOIBLE?
Os dados são publicados sob a licença Creative Commons Attribution-ShareAlike 3.0 (CC BY-SA 3.0).