Últimas noticias, tutoriales y perspectivas sobre IA
Microsoft lanza Phi-3.5, un modelo de 4B parámetros con arquitectura MoE y ventana de contexto de 128K, optimizado para dispositivos móviles y razonamiento avanzado.
xAI lanza Grok-2 en agosto 2024. Rivaliza con GPT-4o y Claude 3.5. API, benchmarks y uso en X.
Naver lanza su modelo más avanzado con 104B parámetros y ventana de contexto de 100K tokens, diseñado específicamente para el ecosistema coreano.
Black Forest Labs lanza FLUX.1, un modelo de 12B parámetros que supera a los líderes propietarios en calidad de imagen y eficiencia.
Mistral AI lanza Mistral Large 2 con 123B parámetros y pesos abiertos. Un análisis técnico profundo.
Meta AI lanza Llama 3.1, un hito histórico con 405B parámetros y ventana de 128K tokens, estableciendo nuevos estándares en inteligencia artificial abierta.
Mistral AI y NVIDIA presentan NeMo, un modelo de 12B parámetros optimizado para hardware eficiente con ventana de contexto de 128K.
Shanghai AI Lab lanza InternLM 2.5, un modelo de 20B parámetros que redefine el rendimiento en matemáticas y código abierto.
Google DeepMind libera Gemma 2 el 27 de junio de 2024. Modelos de 9B y 27B con distilación de Gemini, rendimiento superior y licencia Apache 2.0.