Magna Concursos

Foram encontradas 5.237 questões.

2218564 Ano: 2022
Disciplina: TI - Ciência de Dados e BI
Banca: FGV
Orgão: MPE-SC

O método random forests para classificação ou regressão potencializa alguns benefícios das árvores de decisão e por isso é preferido em certas situações.

O uso de random forests seria vantajoso em relação à árvore de decisão no seguinte caso:

 

Provas

Questão presente nas seguintes provas
2218563 Ano: 2022
Disciplina: TI - Ciência de Dados e BI
Banca: FGV
Orgão: MPE-SC

Uma biblioteca está classificando os seus frequentadores em grupos literários para facilitar a aquisição e a organização dos livros. Isso foi feito aplicando o algoritmo KNN ao banco de dados de usuários da biblioteca, incluindo alguns dos campos de informação como atributos, tais como idade e nível de formação acadêmica. Em um experimento, uma segunda classificação foi feita usando um conjunto maior de atributos, incluindo ambos de maior ou menor relevância percebida com relação aos grupos definidos.

A segunda classificação tende a ser:

 

Provas

Questão presente nas seguintes provas
2218556 Ano: 2022
Disciplina: TI - Ciência de Dados e BI
Banca: FGV
Orgão: MPE-SC

Na avaliação de um modelo para detecção de fraude, foi utilizado um conjunto de dados conhecido que resultou na matriz de confusão abaixo.

  Predito
Modelo Fraude Não Fraude
Fraude 4 96
Não Fraude 1 9999

É correto afirmar que o modelo apresenta:

 

Provas

Questão presente nas seguintes provas
2217743 Ano: 2022
Disciplina: TI - Ciência de Dados e BI
Banca: FGV
Orgão: TJ-DFT

Utilizando a Linguagem R tem-se um objeto x como consta a seguir.

x

## [1] 1 3 4 3 4 <NA>

## Levels: 1 3 4

is.factor(x)

## [1] TRUE

O comando que resulta na soma dos elementos numéricos de x é:

 

Provas

Questão presente nas seguintes provas
2217673 Ano: 2022
Disciplina: TI - Ciência de Dados e BI
Banca: FGV
Orgão: TJ-DFT

Lino precisa preparar um grande volume de dados para minerar realizando operações de limpeza, adequação de formato, exclusão de brancos e inclusão de novos atributos derivados.

Para realizar o pré-processamento dos dados, Lino deve usar uma ferramenta do tipo:

 

Provas

Questão presente nas seguintes provas
2217672 Ano: 2022
Disciplina: TI - Ciência de Dados e BI
Banca: FGV
Orgão: TJ-DFT

Maria está explorando a seguinte tabela da base de dados de vendas do mercado HortVega:

IDvenda

ItensComprados

1

Cacau, castanha, cogumelo, chia

2

Cacau, chia

3

Cacau, aveia

4

Castanha, cogumelo, tâmara

Utilizando técnicas de Mineração de Dados, Maria encontrou a seguinte informação:

Se um cliente compra Cacau, a probabilidade de ele comprar chia é de 50%. Cacau => Chia, suporte = 50% e confiança = 66,7%.

Para explorar a base de dados do HortVega, Maria utilizou a técnica de Mineração de Dados:

 

Provas

Questão presente nas seguintes provas
2217525 Ano: 2022
Disciplina: TI - Ciência de Dados e BI
Banca: FGV
Orgão: TJ-DFT

A tradução automática de texto, embora possua raízes na metade do século passado, vem recebendo melhorias substanciais na última década, alimentadas pelo crescimento do poder computacional, disponibilidade de dados linguísticos e inovações técnicas.

Com relação às inovações, e levando em consideração os recursos mencionados, a alternativa que apresenta apenas vantagens da Tradução Automática Neural (NMT) sobre técnicas de Tradução Automática Estatística (SMT) é:

 

Provas

Questão presente nas seguintes provas
2217524 Ano: 2022
Disciplina: TI - Ciência de Dados e BI
Banca: FGV
Orgão: TJ-DFT

Um analista precisa construir um modelo de tópicos para uma grande base de documentos legais, mas há uma preocupação quanto à interpretabilidade do modelo e à capacidade de inspecionar os resultados.

Considerando essa preocupação, a técnica mais apropriada para a construção do modelo e a razão da escolha são, respectivamente:

 

Provas

Questão presente nas seguintes provas
2217523 Ano: 2022
Disciplina: TI - Ciência de Dados e BI
Banca: FGV
Orgão: TJ-DFT

Considere o parágrafo a seguir.

“Os beija-flores são aves de pequeno porte, que medem em média de 6 a 12 centímetros de comprimento e pesam de 2 a 6 gramas. Maioria dos bicos são normalmente longos, mas o formato preciso varia bastante com a espécie e está adaptado ao formato da flor que constitui a base da alimentação de cada tipo de beija-flor.”

E seu sumário, obtido através de um modelo de sumarização automática:

“Os beija-flores são aves de pequeno porte, com os bicos normalmente longos cujo formato varia com a espécie, dependendo do formato da flor que constitui a base da alimentação de cada tipo de beija-flor.”

Com relação à técnica utilizada para essa sumarização, a alternativa que apresenta, respectivamente, o tipo de sumarização realizada e a evidência que nos permite classificá-la é:

 

Provas

Questão presente nas seguintes provas
2217522 Ano: 2022
Disciplina: TI - Ciência de Dados e BI
Banca: FGV
Orgão: TJ-DFT

Um cientista de dados está ponderando sobre a aplicação de um modelo Paragraph Vector (PV-DM) sobre uma coleção de documentos, no lugar de usar a média de vetores de palavras em cada documento.

Uma razão pela qual ele deveria aplicar PV-DM, e uma contrapartida à sua aplicação, são, respectivamente:

 

Provas

Questão presente nas seguintes provas