Foram encontradas 5.237 questões.
A respeito de KNN (k-nearest neighbours), SVM (support vector machines), deep learning e técnicas de agrupamento, julgue os itens a seguir.
KNN é um algoritmo de aprendizado supervisionado não paramétrico que não pode ser utilizado em problemas de classificação, uma vez que seu objetivo é prever valores numéricos e não valores categóricos.
Provas
Julgue os próximos itens, relativos a Naive Bayes e random forest.
Nas árvores de decisão e em random forest, são utilizadas técnicas estatísticas com o objetivo de se produzir, a partir de um conjunto de observações, uma predição de valores em função de uma ou mais variáveis independentes contínuas e(ou) binárias.
Provas
Julgue os itens que se seguem, relativos a conceitos de data warehouse, técnicas de modelagem dimensional e otimização de bases de dados para BI.
Em regra, as chaves substitutas são incorporadas nas tabelas de dimensões de um data warehouse relacional para atribuir um identificador único para cada registro nas tabelas de dimensões.
Provas
Acerca do fluxo de Big Data, julgue os itens que se seguem.
Na etapa de captura de Big Data, grandes volumes de dados são armazenados em bancos de dados NoSQL, devido à sua escalabilidade e à sua flexibilidade.
Provas
Acerca do fluxo de Big Data, julgue os itens que se seguem.
As funções do MapReduce transformam um volume grande de dados em grupamentos segmentados, mantendo na saída a mesma quantidade de dados da entrada.
Provas
Acerca do fluxo de Big Data, julgue os itens que se seguem.
O serviço ElasticSearch utiliza índices divididos em fragmentos, de maneira que cada nó armazena diversos fragmentos e atua na coordenação das operações nos vários fragmentos.
Provas
A respeito de Big Data, julgue os próximos itens.
Subconjunto de um data warehouse, o data mart é especializado em uma área específica de uma organização.
Provas
A respeito de Big Data, julgue os próximos itens.
Em um data lake, os dados são depositados em estado bruto, sem terem passado por qualquer análise e mesmo sem terem uma governança.
Provas
A respeito de Big Data, julgue os próximos itens.
Em Big Data, ruídos consistem em informações extras que acabam deturpando as análises, enquanto overfitting designa a interpretação equivocada dos ruídos como dados legítimos.
Provas
Julgue os próximos itens, referentes ao processamento de linguagem natural.
A lematização prescinde do POS tagging para que as palavras sejam reduzidas corretamente, pois todas as palavras são reduzidas ao mesmo lemma, independentemente de sua classe gramatical.
Provas
Caderno Container