Magna Concursos

Foram encontradas 5.237 questões.

2571235 Ano: 2022
Disciplina: TI - Ciência de Dados e BI
Banca: FGV
Orgão: CGU

Dois colegas de um time de ciência de dados discutem o novo projeto do time: avaliar um grupo de unidades de negócio e tentar, através de algumas características compartilhadas, separá-las em grupos. O objetivo é migrar de um cenário em que são elaborados contratos individuais para um cenário em que possam ser elaborados contratos por grupo.

Alice acha que deve ser usado um método supervisionado. Ela escolhe o K-means Clustering e propõe ajustar os hiperparâmetros C e sigma para alcançar um resultado adequado.

Bob prefere métodos não supervisionados, já que a base de dados não possui rótulos, e está em dúvida entre utilizar Naive Bayes (em razão de a base de dados ser pequena) ou Decision Trees (por talvez ser necessário ter um modelo explicável).

Analisando as posições de Alice e Bob sobre esse projeto, pode-se afirmar que:

 

Provas

Questão presente nas seguintes provas
2571234 Ano: 2022
Disciplina: TI - Ciência de Dados e BI
Banca: FGV
Orgão: CGU

Considere uma matriz de confusão de um modelo de classificação binária de relatórios financeiros. O modelo classifica os relatórios em fraudulentos ou não fraudulentos.

Se essa matriz apresenta 200 verdadeiros positivos, 100 verdadeiros negativos, 40 erros do “tipo 1” e 20 erros do “tipo 2”, podem-se calcular as métricas de desempenho aproximadas como:

 

Provas

Questão presente nas seguintes provas
2571233 Ano: 2022
Disciplina: TI - Ciência de Dados e BI
Banca: FGV
Orgão: CGU

Uma organização deseja implementar um pipeline de dados e está avaliando a opção mais adequada para o seu contexto de operação. Em torno de 40% dos dados consumidos pela organização se encontram em planilhas eletrônicas que contêm dados sensíveis, produzidas semanalmente por suas unidades de negócio. Os outros 60% dos dados se encontram em alguns bancos de dados relacionais de sistemas de produção da organização. O tamanho da base é de moderado a pequeno, mas existe a necessidade de conformidade com normas de privacidade e confidencialidade dos dados. O objetivo do pipeline é fornecer insumos para um departamento que realiza análises de dados com métodos não supervisionados de aprendizagem de máquina para elaborar relatórios periódicos mensais. A organização está avaliando a construção de um Armazém de Dados (ETL) ou de um Lago de Dados (ELT).

A proposta de modelo adequada e corretamente justificada é:

 

Provas

Questão presente nas seguintes provas
2571232 Ano: 2022
Disciplina: TI - Ciência de Dados e BI
Banca: FGV
Orgão: CGU

Um time de ciência de dados utilizou um modelo linear para resolver uma tarefa de análise de dados financeiros provenientes de diferentes unidades de uma organização. Um membro do time, que não participou da modelagem, testa o modelo e verifica que ele apresenta um péssimo resultado.

Preocupado, ele busca os resultados apresentados no treino e pode concluir que ocorreu:

 

Provas

Questão presente nas seguintes provas
2571230 Ano: 2022
Disciplina: TI - Ciência de Dados e BI
Banca: FGV
Orgão: CGU

Considere as sentenças a seguir.

A = “Eu gostei do livro, apesar do livro ser longo”;
B = “Esse livro é muito legal”;
C = “Eu não gostei do livro, não gosto muito desse autor”.

Vamos considerar a seguinte classificação sobre o sentido das sentenças acima:

A – positiva;
A – positiva;
B – negativa.

Para calcular as probabilidades de uma sentença ser positiva e de uma determinada palavra aparecer na sentença, dado que a sentença é positiva, em Aprendizado de Máquinas, pode-se usar o Naive Bayes.

Com a utilização dessa técnica, e com base nos dados das três sentenças acima, os valores das estimativas de máxima verossimilhança de P(positiva) e P(livro|positiva) são, respectivamente:

 

Provas

Questão presente nas seguintes provas
2571229 Ano: 2022
Disciplina: TI - Ciência de Dados e BI
Banca: FGV
Orgão: CGU

Como parte de um esforço para melhorar a produtividade, uma empresa vem medindo o tempo gasto em cada tarefa do seu principal processo produtivo. Uma das tarefas, que envolve carregar material em uma máquina, ocorre uma vez por dia e teve os seguintes tempos medidos na semana anterior, em minutos:

Seg

Ter Qua Qui Sex
80 76 85 68 56

Considerando um modelo de regressão linear ajustado para perda mínima, usando as medições da semana anterior, o valor residual com relação ao modelo, para o tempo de 70 minutos medido na quinta-feira da semana atual é, em minutos:

 

Provas

Questão presente nas seguintes provas
2571228 Ano: 2022
Disciplina: TI - Ciência de Dados e BI
Banca: FGV
Orgão: CGU

Durante a elaboração de um sistema de busca de informações biomédicas, foi construído um modelo de linguagem vetorial não contextual para estimar relações de similaridade semântica necessárias para comparação entre queries e documentos. Entretanto, verificou-se nos testes iniciais que o desempenho do modelo ficou insatisfatório, devido a muitos termos técnicos presentes nos documentos testados, que não haviam sido incorporados ao modelo.

Para aliviar esse problema, uma tarefa de processamento do texto e seu estágio correspondente no processamento de linguagem natural que poderiam ser aplicados na construção do modelo são, respectivamente:

 

Provas

Questão presente nas seguintes provas
2571216 Ano: 2022
Disciplina: TI - Ciência de Dados e BI
Banca: FGV
Orgão: CGU

No âmbito do DAMA-DMBOK, com referência à Governança de Dados, a figura dos Data Stewards caracteriza-se como:

 

Provas

Questão presente nas seguintes provas
2536546 Ano: 2022
Disciplina: TI - Ciência de Dados e BI
Banca: CONSULPAM
Orgão: Pref. Irauçuba-CE
Na área de suporte à decisão, existe um tipo de estrutura, na qual os dados são organizados de forma a permitir análises multidimensionais rápidas e simples por parte do usuário. Essas estruturas fazem referência à existência de múltiplas variáveis a serem consideradas, estas estruturas em fatos, dimensões e medidas. Assinale a alternativa que apresenta o nome desta estrutura de dados multidimensional utilizada em soluções de suporte à decisão.
 

Provas

Questão presente nas seguintes provas
2347284 Ano: 2022
Disciplina: TI - Ciência de Dados e BI
Banca: SELECON
Orgão: Pref. Pontes Lacerda-MT
Provas:

Atualmente, conforme a tecnologia evolui, novos termos vão surgindo, particularmente com o aumento da importância dos dados na criação de estratégias de crescimento e tomadas de decisão. Nesse contexto, dois termos se destacam, descritos a seguir:

I. É um repositório central de informações que podem ser analisadas para tomar decisões mais adequadas. Os dados fluem de sistemas transacionais, bancos de dados relacionais e de outras fontes. Analistas de negócios, engenheiros de dados, cientistas de dados e tomadores de decisões acessam os dados por meio de ferramentas de inteligência de negócios (BI), clientes SQL e outros aplicativos de análise.

II. É um processo analítico no qual grande quantidade de dados são explorados com o objetivo de encontrar padrões relevantes ou relação sistemática entre variáveis, os quais são validados. Todo esse processo acontece em três etapas: exploração, construção de modelo (padrão) e validação. As ferramentas empregadas analisam dados em busca de oportunidades ou problemas e fazem o diagnóstico do comportamento dos negócios. Sendo assim, cabe ao usuário utilizar o conhecimento para produzir vantagens competitivas.

Os termos descritos em I e II representam os conceitos, respectivamente, de:

 

Provas

Questão presente nas seguintes provas