Uma outra forma de atender às premissas da computação escalável é utilizando a computação distribuída. A computação distribuída representa uma coleção de computadores independentes aparentando ser um único computador, com as seguintes características: o hardware possuindo capacidade autônoma, o software sendo visto pelos usuários como uma única máquina e utilizando um conceito-chave: a transparência. Considerando a transparência como conceito-chave da computação distribuída, assinale a alternativa que descreve, corretamente, como a transparência pode ser entendida.
As computações paralela e distribuída atendem às premissas da computação escalável, cada uma das quais com suas particularidades, características, vantagens e desvantagens, que fazem com que se defina qual é a melhor alternativa para o projeto computacional que se busca. Correlacione, adequadamente, o tipo de computação com os elementos a seguir. 1. Paralela 2. Distribuída I. Execução de backup mais complexa. II. Dependência da rede utilizada. III. Erros dependentes do momento exato em que o escalonador do SO realiza um chaveamento de contexto. Assinale a alternativa que correlaciona, adequadamente, os dois grupos de informação.
A computação paralela, definida como o uso simultâneo de múltiplos recursos computacionais para resolver um problema e que representa uma das aplicações para a computação escalável, pode possuir mais de uma solução para atender ao processamento em paralelo. Baseando-se na possibilidade de mais de uma solução para a computação paralela, identifique se são (V) verdadeiras ou (F) falsas as afirmativas a seguir. I. ( ) Um único computador com múltiplos processadores representa uma das possibilidades de solução para a computação paralela. II. ( ) Um número arbitrário de computadores conectados pela rede representa uma das possibilidades de solução para a computação paralela. III. ( ) Uma combinação de um único computador com múltiplos processadores e um número arbitrário de computadores conectados pela rede representa uma das possibilidades de solução para a computação paralela. Assinale a alternativa que apresenta a sequência correta.
A computação paralela, um dos processos computacionais que atende às premissas da computação escalável, possui, assim como quaisquer áreas da computação, os seus “jargões”, palavras e termos que representam os seus processos. Analise o trecho a seguir: Define o tamanho do trabalho atribuído a cada thread antes que elas se sincronizem. Indica a relação entre computação e comunicação dos trechos de código gerados a partir da divisão do problema a ser resolvido. Assinale a alternativa que define, corretamente, o termo da computação paralela para a definição do trecho anterior.
O cluster consiste na integração de dois ou mais sistemas a fim de operarem de maneira simultânea no processamento de dados, já o intracluster refere-se à composição de grupos de objetos apresentando elevada semelhança interna. Ambos os itens são utilizados para a determinação da estatística GAP. Considerando essas informações, assinale a alternativa que apresenta, corretamente, informações práticas sobre o uso da estatística GAP.
Em análise de dados são utilizados critérios para organizar e possibilitar resultados válidos, sendo esses critérios estatísticos e históricos. A partir disso, é possível projetar resultados futuros para prever um possível problema sobre determinada situação. Quanto a isso, assinale a alternativa que apresenta uma crítica correta sobre os critérios internos.
Os algoritmos baseados em densidade identificam agrupamentos com base na vizinhança dos elementos, em que, por meio da densidade, pode-se associar um ponto por contagem da quantidade de pontos vizinhos próximos a esse ponto. Com base nisso, assinale a alternativa correta sobre os algoritmos baseados em densidade.
A análise relativa de dados consiste na comparação de dados ou de grupos de dados com a intenção de identificar os resultados mais relevantes para a resolução de determinado problema. Quanto a isso, marque a alternativa correta que explica corretamente os critérios relativos.
A hipótese de um estudo é uma afirmação que poderá ser verdadeira ou falsa, para isso existem as análises de dados que são feitas com o intuito de se provar a veracidade dessas hipóteses. Por isso são realizados estudos que possibilitam a utilização de índices e critérios de validação. Com base nisso, assinale a alternativa correta sobre a aplicação de índice de validação.
Em relação ao algoritmo de agrupamento k-médias, podemos afirmar que: I - O algoritmo k-médias é um algoritmo particional baseado no erro quadrático médio. II - O algoritmo k-médias particiona o conjunto de dados em k clusters, em que o valor de k é fornecido pelo usuário. III - O algoritmo k-médias é sensível à escolha inicial dos centroides.
A análise de agrupamentos é feita por meio da verificação de semelhanças ou dissemelhança entre dados de um grupo que está sendo analisado. Essa verificação permite obter informações relacionadas às propriedades ou características de um produto, a fim de obter respostas para algum estudo. Com base nisso, assinale a alternativa correta que compreende o objetivo da análise de agrupamentos.
O agrupamento para a mineração de dados deve ser realizado por meio de passos ou etapas que possibilitem a identificação de anomalias, correlações e padrões entre itens. As etapas terão a função de gerar informações referentes aos dados que estão sendo estudados. A respeito disso, assinale a alternativa correta sobre a explicação das etapas de análise de agrupamento.
Para que o processo de mineração de dados seja bem-sucedido, é preciso que as etapas do processo de agrupamento de dados sejam realizadas passo a passo, até que se chegue em uma das últimas etapas do processo, que é a etapa de validação. Quanto a isso, assinale a alternativa correta sobre o processo de validação.
O aprendizado de máquina é um subcampo da Inteligência Artificial (IA) que se concentra no desenvolvimento de algoritmos e modelos estatísticos, os quais permitem que os computadores aprendam com os dados e façam previsões ou decisões sem serem explicitamente programados para isso. Com relação ao aprendizado de máquina e à indução de modelos, identifique se são (V) verdadeiras ou (F) falsas as afirmativas a seguir. ( ) A indução de modelos tem como objetivos identificar e relacionar os recursos de entrada a uma variável de destino. ( ) No aprendizado supervisionado, não são utilizados rótulos, sendo necessário realizar o mapeamento somente da saída. ( ) No processo de indução, o modelo treinado passa por uma validação em que há dados de testes específicos e sem generalização. Assinale a alternativa que apresenta a sequência CORRETA.
Os algoritmos de Aprendizado de Máquina (AM) têm a função de aprendizagem, como o próprio nome diz, e se referem a um grupo de dados ou a uma hipótese que poderá relacionar em um objeto atributos de entrada com ligação aos de saída, associando seus valores. Com base nisso, assinale a alternativa correta sobre esse algoritmo.
A exploração de dados no aprendizado de máquina se refere ao processo de examinar e resumir um conjunto de dados para obter uma melhor compreensão de suas características, estrutura e relacionamentos entre as variáveis. O objetivo da exploração de dados é identificar padrões, outliers e relacionamentos entre variáveis, que podem informar a escolha de recursos e modelos para um problema de aprendizado de máquina. Considerando o apresentado, analise as afirmativas a seguir sobre a exploração de dados e as correlacione adequadamente aos termos ou ferramentas às quais se referem. Técnica de visualização Técnica de limpeza de dados Técnica de redução de dimensionalidade Processo de identificação e remoção de dados incorretos, incompletos ou irrelevantes de um conjunto de dados. Processo de redução do número de variáveis ou recursos em um conjunto de dados. Gráficos de dispersão, histogramas e gráficos de caixa podem ajudar a visualizar a distribuição e as relações entre as variáveis em um conjunto de dados. Assinale a alternativa que correlaciona adequadamente os dois grupos de informação.
A caracterização de dados no aprendizado de máquina se refere ao processo de entender e resumir as propriedades de um conjunto de dados. É uma etapa importante no aprendizado de máquina, pois fornece informações sobre os dados e ajuda a identificar possíveis desafios e limitações. No aprendizado de máquina, existem vários tipos de dados que podem ser usados para treinar e testar modelos. Considerando o texto apresentado anteriormente, observe as afirmativas a seguir, sobre os tipos de dados, e as correlacione adequadamente aos termos ou ferramentas às quais se referem. Dados numéricos Dados categóricos Dados de série temporal São comumente usados em problemas relacionados à previsão, como previsão de preços de ações ou previsão do tempo. Podem ser nominais, significando que as categorias não têm ordem, ou ordinal, significando que as categorias não têm uma ordem específica. Podem ser usados para representar variáveis contínuas, como altura ou peso, ou variáveis discretas, como o número de itens vendidos. Assinale a alternativa que correlaciona adequadamente os dois grupos de informação.
Em relação aos modelos preditivos de aprendizado de máquina, é correto afirmar que: I - Quando os valores do atributo-alvo no conjunto de dados de treinamento identificam categorias ou classes, o estimador é um classificador. II - Quando o atributo-alvo no conjunto de dados de treinamento contém valores numéricos contínuos, o estimador é regressor. III - Os modelos preditivos são utilizados no aprendizado não supervisionado para a realiza ção de previsões de valores desconhecidos.
Com relação ao algoritmo baseado em distância k-NN (Nearest Neighbour), podemos afirmar que: I - O k-NN é considerado um algoritmo "preguiçoso" pois não existe um processo de aprendizado para indução de um modelo. Sendo que o processamento pesado é feito somente na etapa de inferência (após o treinamento). II - O k-NN tem a vantagem de ser incremental, ou seja, o conjunto de treinamento pode ser aumentando simplesmente armazenando novos objetos em memória. III- O k-NN pode ser utilizado para estimação de atributos em dados incompletos.
Considere um problema de classificação no qual existem duas classes (A e B). Utilizou-se o algoritmo k-NN para se determinar a qual classe pertencia um ponto de teste x t , utilizando a distância euclidiana como medida de distância d ( x t , x i ) entre o ponto x t e os pontos x i pertencentes ao conjunto de objetos de treinamento, conforme a tabela mostrada abaixo. Foram realizadas três classificações, a primeira utilizando k=1, a segunda utilizando k=3 e a terceira utilizando k=5. Qual das alternativas abaixo corresponde à classificação para o ponto x t em cada uma das classificações respectivamente? pontos classe d ( x t , x i ) 1 A 6,2 2 A 5,6 3 A 3,8 4 A 3,4 5 B 5,1 6 B 5,5 7 B 3,1
O aprendizado bayesiano pode ser classificado como supervisionado com base em rótulos e instâncias ou classes. Por meio do algoritmo é possível usar equações para a determinação de probabilidades e estatísticas com o intuito de se conseguir a classificação de dados necessária para a verificação. Com base no texto acima sobre aprendizado bayesiano, identifique se são (V) verdadeiras ou (F) falsas as afirmativas a seguir. ( ) Ao ter o domínio, é possível que ele seja embutido nas probabilidades que serão determinadas. ( ) O algoritmo de Aprendizagem de Máquinas (AM) permite classificações com base em evidências. ( ) O algoritmo de Aprendizagem de Máquinas (AM) bayesiano trabalha sem uma probabilidade associada. Assinale a alternativa que apresenta a sequência CORRETA.
A análise de algoritmos é utilizada para a verificação de tempos, cujo tempo depende de instâncias que deverão ser descobertas por meio da análise dos dados existentes nos conjuntos, sendo usados algoritmos binários e lineares para tal fim. Considerando os algoritmos que contribuem para a aprendizagem em máquinas e com relação à análise de algoritmos, assinale a alternativa que apresenta a hipótese correta para utilizar essa análise.
Podemos dizer que um algoritmo ________ de AM (Aprendizado de Máquina) irá aprender (induzir) um modelo que representa um ________ , a partir de um conjunto de dados __________ .
A mineração de dados pode ser feita por meio de métodos baseados em distância, ou seja, são métodos que possibilitam a análise por meio de algoritmos de vizinhos que estejam mais próximos, sendo um algoritmo de aprendizagem de máquina do tipo simples. Considerando os algoritmos que contribuem para a aprendizagem em máquinas, observe as afirmativas a seguir, com relação às variações existentes ao serem utilizados os métodos baseados em distância e as correlacione adequadamente. Algoritmo preguiçoso. Algoritmo do I - Vizinho mais próximo. Diagrama de Voronoi É um conjunto de poliedros convexos desenhados pelo algoritmo I-NN. É uma variação estabelecida pela quantidade de vizinhos considerados. É uma variação que não aprende, somente realiza memorização de objetos. Assinale a alternativa que correlaciona adequadamente os dois grupos de informação.
Em relação às diferentes modalidades de serviços de processamento de Aprendizado de Máquina em nuvem, podemos afirmar que: I – Na modalidade MLaaS, o usuário basicamente irá fornecer apenas o conjunto de dados, sendo toda a parte de softwares e processamento provida pelo serviço em nuvem. II – Uma das possibilidades é contratar apenas recursos de hardware através de uma Máquina Virtual (VM). III – AWS, Google Cloud e Azure são exemplos de fornecedores de serviços de processamento de Aprendizado de Máquina em nuvem.