Programação
19h: Como se tornar cientista de dados - A profissão mais cobiçada do século XXI
Essa palestra inicia falando sobre o que é ciência de dados, explica o ciclo de vida dos dados e os diversos papéis que atuam nele. Trás um mapa básico com possíveis caminhos para quem está iniciando na área e > apresenta alguns canais disponíveis para aprofundar o aprendizado.
Amélia Pessoa
20h: Como não fazer Data Science: muito dado ou pouca arquitetura?
É fácil se admirar com o poder, flexibilidade e expressividade que as ferramentas de computação distribuída proveem. Apesar do ecossistema ser muito profundo, é tentador querer usar todas as ferramentas do estado da arte. No entanto, por muitas vezes o seu problema não é de Big Data, e sim de arquitetura: será que essa ferramenta é realmente necessária para o meu problema? Nessa palestra, iremos conversar sobre a história e falar das dores de como a arquitetura de dados na In Loco vem evoluindo, e como podemos prover agora uma infraestrutura para Data Science muito mais eficientemente.
Guilherme Peixoto
21h: Pipelines de preparação de dados com Luigi
Luigi é uma ferramenta em Python para definição e execução escalável de pipelines para tratamento de dados. Nessa palestra, veremos os principais conceitos envolvidos na criação de um pipeline usando Luigi, bem como exemplos de sua aplicação e boas práticas encontradas.
Felipe Martins