Morfologia e árvores de dependências

O método analyzeSyntax devolve detalhes sobre a estrutura linguística do texto indicado. Para cada token no texto, a API Natural Language fornece informações sobre a respetiva estrutura interna (morfologia) e a respetiva função na frase (sintaxe).

A morfologia é o estudo da estrutura interna das palavras. A morfologia centra-se na forma como os componentes de uma palavra (radicais, palavras-raiz, prefixos, sufixos, etc.) são organizados ou modificados para criar significados diferentes. Por exemplo, o inglês adiciona frequentemente "-s" ou "-es" ao final dos substantivos contáveis para indicar pluralidade e "-d" ou "-ed" a um verbo para indicar o pretérito. O sufixo "-mente" é adicionado aos adjetivos para criar advérbios (por exemplo, "feliz" [adjetivo] e "felizmente" [advérbio]).

A API Natural Language usa a análise morfológica para inferir informações gramaticais sobre as palavras.

A morfologia varia muito entre os idiomas. Em idiomas como o russo, as terminações das palavras indicam a função de uma palavra numa frase (por exemplo, "книга" [livro – caso nominativo] torna-se "книгу" [caso acusativo] quando é o objeto direto de um verbo). Isto significa que a ordem das palavras pode variar sem alterar o significado da frase, embora uma ordem das palavras diferente afete a adequação contextual. Os idiomas como o inglês e o mandarim, que não têm afixos que indicam a capitalização, dependem mais da ordem das palavras numa frase para indicar as funções respetivas das palavras. Como resultado, a análise morfológica depende muito do idioma de origem e da compreensão do que é suportado nesse idioma.

A sintaxe é o estudo da estrutura das frases. A sintaxe e a morfologia funcionam em conjunto para indicar relações gramaticais, com diferentes idiomas a dividir o trabalho entre si de forma diferente. Por exemplo, o russo usa um afixo para indicar a função de objeto direto ("у" em "книгу"), enquanto o inglês usa a ordem das palavras, em que o objeto direto segue o verbo (read the book).

A resposta analyzeSyntax devolve informações morfológicas no campo partOfSpeech e a relação sintática entre palavras no campo dependencyTree.

Classes gramaticais

Num pedido sintático, as informações morfológicas e de classe gramatical são devolvidas no campo partOfSpeech da resposta. O campo partOfSpeech contém um conjunto de subcampos com informações de classe gramatical (POS), bem como informações morfológicas mais explícitas. Estes subcampos estão listados abaixo.

  • tag denota a parte do discurso através de uma etiqueta POS de grão grosso (SUBSTANTIVO, VERBO, etc.) e fornece informações de sintaxe de superfície de nível superior. As etiquetas de POS são úteis se quiser criar padrões e/ou reduzir a ambiguidade para a análise de linguagem subsequente (por exemplo, "train" etiquetado como um SUBSTANTIVO em vez de um VERBO).

  • number denota o número gramatical de uma palavra. Em inglês, o sufixo "-s" é adicionado a substantivos contáveis para indicar mais do que um (por exemplo, "dog+s" indica mais do que um cão). A ausência do sufixo plural é frequentemente referida como a forma singular. Alguns idiomas, como o árabe, também têm a noção de um