Machine learning com Apache Spark
3 minutos de leitura

Nos estudos de Machine Learning temos vários frameworks, bibliotecas e outras outras tecnologias que ajudam a montar nossos modelos da forma que precisamos. No entanto, a escolha de qual ferramenta utilizar depende muito do projeto que precisa ser construído.
Big Data é uma área de pesquisa e conhecimento que busca por maneiras de tratar, analisar e gerar conhecimento através de grandes conjuntos de dados (na ordem de terabytes). Projetos que trabalham com Big Data e aprendizado de máquina têm uma demanda crescente no mercado de Data Science.
Muitas pessoas se deparam com problemas em lidar com esse tipo de dado, utilizando as bibliotecas mais conhecidas para criação de modelos. Na linguagem Python, por exemplo, a scikit-learn é uma das mais populares bibliotecas open source para Machine Learning. Ela oferece aporte de vários conjuntos de modelos supervisionados e não-supervisionados para aprendizado de máquina e, por esse motivo, é muito utilizada em estudos e montagem de projetos.

Autor(a)
Mirla Costa
Instrutora em Data Science, graduada em Engenharia Elétrica pela UFPI com pesquisa focada em Aprendizado de Máquina e Inteligência Computacional. Amante de programação, tecnologia, cachorros, animações e jogar RPG de mesa.
Inscreva-se em nossa Newsletter
Fique por dentro de conteúdos, insights e oportunidades do universo tech. Receba novidades e lançamentos direto no seu e-mail.



