Fraud detection is a classic adversarial analytics challenge: As soon as an automated system successfully learns to stop one scheme, fraudsters move on to attack another way. Each scheme requires looking for different signals (i.e. features) to catch; is relatively rare (one in millions for finance or e-commerce); and may take months to investigate a single case (in healthcare or tax, for example) – making quality training data scarce. This talk will cover a code walk-through, the key lessons learned while building such real-world software systems over the past few years. We'll look for fraud signals in public email datasets, using IPython and popular open-source libraries (scikit-learn, statsmodel, nltk, etc.) for data science and Apache Spark as the compute engine for scalable parallel processing. David will iteratively build a machine-learned hybrid model – combining features from different data sources and algorithmic approaches, to catch diverse aspects of suspect behavior: - Natural language processing: finding keywords in relevant context within unstructured text - Statistical NLP: sentiment analysis via supervised machine learning - Time series analysis: understanding daily/weekly cycles and changes in habitual behavior - Graph analysis: finding actions outside the usual or expected network of people - Heuristic rules: finding suspect actions based on past schemes or external datasets - Topic modeling: highlighting use of keywords outside an expected context - Anomaly detection: Fully unsupervised ranking of unusual behavior Apache Spark is used to run these models at scale – in batch mode for model training and with Spark Streaming for production use. We’ll discuss the data model, computation, and feedback workflows, as well as some tools and libraries built on top of the open-source components to enable faster experimentation, optimization, and productization of the models.

Hora

19:00 - 20:00 hs GMT+1

Organizador

Machine Learning
Compartir
Enviar a un amigo
Mi email *
Email destinatario *
Comentario *
Repite estos números *
Control de seguridad
Agosto / 2025 303 webinars
Lunes
Martes
Miércoles
Jueves
Viernes
Sábado
Domingo
Lun 28 de Agosto de 2025
Mar 29 de Agosto de 2025
Mié 30 de Agosto de 2025
Jue 31 de Agosto de 2025
Vie 01 de Agosto de 2025
Sáb 02 de Agosto de 2025
Dom 03 de Agosto de 2025
Lun 04 de Agosto de 2025
Mar 05 de Agosto de 2025
Mié 06 de Agosto de 2025
Jue 07 de Agosto de 2025
Vie 08 de Agosto de 2025
Sáb 09 de Agosto de 2025
Dom 10 de Agosto de 2025
Lun 11 de Agosto de 2025
Mar 12 de Agosto de 2025
Mié 13 de Agosto de 2025
Jue 14 de Agosto de 2025
Vie 15 de Agosto de 2025
Sáb 16 de Agosto de 2025
Dom 17 de Agosto de 2025
Lun 18 de Agosto de 2025
Mar 19 de Agosto de 2025
Mié 20 de Agosto de 2025
Jue 21 de Agosto de 2025
Vie 22 de Agosto de 2025
Sáb 23 de Agosto de 2025
Dom 24 de Agosto de 2025
Lun 25 de Agosto de 2025
Mar 26 de Agosto de 2025
Mié 27 de Agosto de 2025
Jue 28 de Agosto de 2025
Vie 29 de Agosto de 2025
Sáb 30 de Agosto de 2025
Dom 31 de Agosto de 2025

.

  • Comparativas de Software

    ¿No te salen las cuentas en la nube?

    La nube tiene importantes ventajas: ahorros de costes, facilidad para trabajar en equipos remotos, menor necesidad de administración de la infraestructura, mejoras de seguridad, etc. Sin embargo, al comentar con algunos clientes la posibilidad de migrar las licencias de Atlassian a cloud, me comentaron que habían hecho alguna experiencia de migración y no le salían tan bien las cuentas. Estos comentarios me hicieron reflexionar sobre cuáles podían ser las causas de que no salieran las cuentas y permitirme ofrecer algunas recomendaciones y consejos. ... Leer más

    Publicado el 22-Dic-2021 • 14.40hs

    0 comentarios

  • TODOS Comparativas de Software PDF

    Comparativas de software ERP para todos los sectores

    Publicado el 27-Set-2021 • 12.50hs

  • TODOS Comparativas de Software PDF

    Comparativas de software ERP para Fabricación

    Publicado el 27-Set-2021 • 09.51hs

.

.

.

.

.

Más Secciones »

Hola Invitado