Introducing Olmo-core 3: Open, scalable training infrastructure for large MoEs

## Introducing Olmo-core 3: Open, scalable training infrastructure for large MoEs

## Introducing Olmo-core 3: Open, scalable training infrastructure for large MoEs - +14 - Building a training stack around how MoEs actually work - Scaling and optimizing MoE training - Scaling into the trillion-parameter range - Built for the next generation of Olmo, open for everyone Today we’re releasing Olmo-core 3, a significant upgrade to our framework for developing large language models featuring a redesigned open mixture-of-experts (MoE) training system. Olmo-core 3 is designed to scale MoE training into the trillion-parameter range while preserving computational efficiency. It’s one…

Читать полностью →

Источник: Hugging Face Blog

Подключаюсь к источникам…

30 главных источников
о мире ИИ

Автоматический перевод, курирование и красивая подача главных статей об искусственном интеллекте.

0
статей
0
источников
9
разделов