Últimas noticias, tutoriales y perspectivas sobre IA
Allen AI presenta OLMo 2 con pesos y datos abiertos bajo Apache 2.0, desafiando a los modelos propietarios en benchmarks críticos.
DeepSeek AI lanza V3, un modelo MoE de 671B entrenado con $5.5M que desafía a GPT-4o en código y matemáticas.
TII presenta Falcon 3, un modelo de 10B parámetros con licencia Apache 2.0, optimizado para multilingüismo y tareas complejas de código.
Microsoft ha lanzado Phi-4, un modelo de código abierto de 14B parámetros que supera a competidores más grandes en matemáticas y STEM. Descubre su arquitectura, precios y rendimiento.
Google DeepMind lanza Gemini 2.0 Flash, un modelo diseñado para la era agéntica con generación nativa de audio e imágenes, duplicando la velocidad de su predecesor.
Meta AI lanza Llama 3.3 el 6 de diciembre de 2024. Un modelo de 70B que iguala el rendimiento de 405B.
OpenAI presenta o1-pro, un modelo de razonamiento avanzado disponible en ChatGPT Pro con capacidades mejoradas para tareas complejas.
Amazon presenta Nova, una familia de modelos multimodales optimizados para AWS Bedrock con rendimiento superior.
Alibaba Cloud presenta Qwen2.5-Coder, un modelo especializado en 6 tamaños que desafía a GPT-4o con 5.5T tokens de entrenamiento y licencia Apache 2.0.