Modelos y plataformas de IA

¿Es todavía relevante el aprendizaje automático tradicional?

mm
Añade Unite.AI a tus fuentes preferidas en Google

En los últimos años, el aprendizaje automático generativo ha mostrado resultados prometedores en la resolución de tareas de inteligencia artificial complejas. Los modelos de inteligencia artificial modernos como ChatGPT, Bard, LLaMA, DALL-E.3 y SAM han demostrado capacidades notables en la resolución de problemas multidisciplinarios como la respuesta a preguntas visuales, la segmentación, el razonamiento y la generación de contenido.

Además, las técnicas de aprendizaje multimodal han surgido, capaces de procesar múltiples modalidades de datos, es decir, texto, imágenes, audio y videos simultáneamente. Con estos avances, es natural preguntarse: ¿estamos cerca del final del aprendizaje automático tradicional (ML)?

En este artículo, examinaremos el estado del paisaje del aprendizaje automático tradicional en relación con las innovaciones de la inteligencia artificial generativa moderna.

¿Qué es el aprendizaje automático tradicional? – ¿Cuáles son sus limitaciones?

El aprendizaje automático tradicional es un término amplio que abarca una amplia variedad de algoritmos impulsados principalmente por estadísticas. Los dos principales tipos de algoritmos de aprendizaje automático tradicional son supervisado y no supervisado. Estos algoritmos están diseñados para desarrollar modelos a partir de conjuntos de datos estructurados.

Los algoritmos de aprendizaje automático tradicional estándar incluyen:

  • Algoritmos de regresión como lineal, lasso y ridge.
  • Agrupación en clusters K-means.
  • Análisis de componentes principales (PCA).
  • Máquinas de soporte vectorial (SVM).
  • Algoritmos basados en árboles como árboles de decisión y bosque aleatorio.
  • Modelos de impulso como gradient boosting y XGBoost.

Limitaciones del aprendizaje automático tradicional

El aprendizaje automático tradicional tiene las siguientes limitaciones:

  1. Escalabilidad limitada: Estos modelos a menudo necesitan ayuda para escalar con grandes y diversos conjuntos de datos.
  2. Preprocesamiento de datos y ingeniería de características: El aprendizaje automático tradicional requiere un preprocesamiento extensivo para transformar los conjuntos de datos según los requisitos del modelo. Además, la ingeniería de características puede ser tediosa y requiere múltiples iteraciones para capturar relaciones complejas entre las características de los datos.
  3. Datos de alta dimensionalidad y no estructurados: El aprendizaje automático tradicional lucha con tipos de datos complejos como imágenes, audio, videos y documentos.
  4. Adaptabilidad a datos no vistos: Estos modelos pueden no adaptarse bien a datos del mundo real que no formaban parte de su conjunto de entrenamiento.

Red neuronal: Pasando del aprendizaje automático al aprendizaje profundo y más allá

Red neuronal: Pasando del aprendizaje automático al aprendizaje profundo y más allá

Los modelos de red neuronal (NN) son mucho más complejos que los modelos de aprendizaje automático tradicional. La red neuronal más simple, el perceptrón multicapa (MLP), consiste en varias neuronas conectadas para comprender la información y realizar tareas, similar a cómo funciona el cerebro humano.

Los avances en las técnicas de red neuronal han sentado las bases para la transición del aprendizaje automático al aprendizaje profundo. Por ejemplo, las redes neuronales utilizadas para tareas de visión por computadora (detección de objetos y segmentación de imágenes) se llaman redes neuronales convolucionales (CNN), como AlexNet, ResNet y YOLO.

Hoy en día, la tecnología de inteligencia artificial generativa está llevando las técnicas de red neuronal un paso más allá, lo que le permite destacarse en varios dominios de inteligencia artificial. Por ejemplo, las redes neuronales utilizadas para tareas de procesamiento de lenguaje natural (como resumen de texto, respuesta a preguntas y traducción) se conocen como transformadores. Los modelos de transformadores prominentes incluyen BERT, GPT-4 y T5. Estos modelos están teniendo un impacto en industrias que van desde la salud, el comercio minorista, el marketing, las finanzas, etc.

¿Todavía necesitamos algoritmos de aprendizaje automático tradicional?

¿Todavía necesitamos algoritmos de aprendizaje automático tradicional?

Aunque las redes neuronales y sus variantes modernas como los transformadores han recibido mucha atención, los métodos de aprendizaje automático tradicional siguen siendo fundamentales. Veamos por qué siguen siendo relevantes.

1. Requisitos de datos más simples

Las redes neuronales exigen grandes conjuntos de datos para el entrenamiento, mientras que los modelos de aprendizaje automático pueden lograr resultados significativos con conjuntos de datos más pequeños y simples. Por lo tanto, el aprendizaje automático es más adecuado para conjuntos de datos estructurados pequeños y viceversa.

2. Simplicidad e interpretabilidad

Los modelos de aprendizaje automático tradicional se basan en modelos estadísticos y de probabilidad más simples. Por ejemplo, una línea de mejor ajuste en regresión lineal establece la relación entre la entrada y la salida utilizando el método de los mínimos cuadrados, una operación estadística.

De manera similar, los árboles de decisión utilizan principios probabilísticos para clasificar los datos. El uso de estos principios ofrece interpretabilidad y facilita a los practicantes de inteligencia artificial la comprensión del funcionamiento de los algoritmos de aprendizaje automático.

Las arquitecturas modernas de redes neuronales como los modelos de transformador y difusión (utilizados típicamente para la generación de imágenes como Stable Diffusion o Midjourney) tienen una estructura de red compleja y multicapa. Comprender estas redes requiere una comprensión de conceptos matemáticos avanzados. Es por eso que también se les conoce como ‘Cajas negras’.

3. Eficiencia de recursos

Las redes neuronales modernas como los grandes modelos de lenguaje (LLM) se entrenan en clusters de GPU costosas según sus requisitos computacionales. Por ejemplo, se informó que GPT4 se entrenó en 25000 GPU de Nvidia (NVDA ) durante 90 a 100 días.

Sin embargo, el hardware costoso y el tiempo de entrenamiento prolongado no son factibles para todos los practicantes o equipos de inteligencia artificial. Por otro lado, la eficiencia computacional de los algoritmos de aprendizaje automático tradicional permite a los practicantes lograr resultados significativos incluso con recursos limitados.

4. No todos los problemas necesitan aprendizaje profundo

El aprendizaje profundo no es la solución absoluta para todos los problemas. Existen escenarios en los que el aprendizaje automático supera al aprendizaje profundo.

Por ejemplo, en diagnóstico y pronóstico médico con datos limitados, un algoritmo de aprendizaje automático para detección de anomalías como REMED produce mejores resultados que el aprendizaje profundo. De manera similar, el aprendizaje automático tradicional es significativo en escenarios con baja capacidad computacional como una solución flexible y eficiente.

Primordialmente, la selección del mejor modelo para cualquier problema depende de las necesidades de la organización o practicante y de la naturaleza del problema en cuestión.

Aprendizaje automático en 2023

Aprendizaje automático en 2023

Imagen generada usando Leonardo AI

En 2023, el aprendizaje automático tradicional sigue evolucionando y compitiendo con el aprendizaje profundo y la inteligencia artificial generativa. Tiene varios usos en la industria, particularmente cuando se trata de conjuntos de datos estructurados.

Por ejemplo, muchas empresas de bienes de consumo lidian con grandes cantidades de datos tabulares y confían en algoritmos de aprendizaje automático para tareas críticas como recomendaciones de productos personalizadas, optimización de precios, gestión de inventario y optimización de la cadena de suministro.

Además, muchos modelos de visión y lenguaje todavía se basan en técnicas tradicionales, ofreciendo soluciones en enfoques híbridos y aplicaciones emergentes. Por ejemplo, un estudio reciente titulado “¿Realmente necesitamos modelos de aprendizaje profundo para la predicción de series temporales!” ha discutido cómo los árboles de regresión de impulso (GBRT) son más eficientes para predicción de series temporales que las redes neuronales profundas.

La interpretabilidad del aprendizaje automático sigue siendo muy valiosa con técnicas como SHAP (Explicaciones aditivas de Shapley) y LIME (Explicaciones locales e interpretaciones de modelos agnósticos). Estas técnicas explican modelos de aprendizaje automático complejos y brindan información sobre sus predicciones, lo que ayuda a los practicantes de aprendizaje automático a comprender mejor sus modelos.

Finalmente, el aprendizaje automático tradicional sigue siendo una solución robusta para diversas industrias que abordan la escalabilidad, la complejidad de los datos y las limitaciones de los recursos. Estos algoritmos son insustituibles para el análisis de datos y la modelización predictiva, y seguirán siendo una parte del arsenal de un científico de datos.

Si temas como este te intrigan, explora Unite AI para obtener más información.

Haziqa es una científica de datos con amplia experiencia en la escritura de contenido técnico para empresas de inteligencia artificial y SaaS.