Ресурсы релиза и предлагаемый текст
Это готовые к публикации файлы и черновой текст. Ни один пост в соцсетях не был отправлен.
| Ресурс | Формат | Хронометраж |
|---|---|---|
| Демо-видео | 1920 × 1080, H.264, 30 видео FPS | 30 секунд, оригинальная скорость реального времени |
| README GIF | Анимированный GIF шириной 1040 пикселей | 15 секунд, оригинальная скорость реального времени |
| Видео на максимальной скорости | 1920 × 1080, H.264, 30 видео FPS | 15 секунд, оригинальная скорость, оптимизированный живой запуск |
| Постер | 1920 × 1080 PNG | Реальное записанное состояние примерно на 85 секунде |
| Исходная запись | JSONL | Весь реальный 100-секундный запуск TTY |
| Происхождение | JSON | Хеш источника, модель, метки времени и хеш рендерера |
Исходный запуск достиг счёта 40 и длины 46, с 1 144 реальными ходами на основе вывода, нулём смертей и нулём вмешательств безопасности. Его целью было 12 решений в секунду ради читаемости. Видео — это рендер записанных ячеек терминала, помеченный на экране как RECORDED RUN · 1×.
Дополнительный клип на максимальной скорости происходит из отдельного 20.01-секундного запуска истинного цвета TTY с --optimize --max-speed: 1 296 ходов при 64.77 ходов/секунду, счёт 44, длина 50, ноль смертей и ноль вмешательств. Он включает запись живого потока терминала; он не сжат по времени. Источник · Происхождение.
Короткий английский черновик
Локальный ИИ, возвращающий вероятности, а не сгенерированный текст.
Laya-MLX запускает открытые модели типизированных решений на Apple Silicon. Смотрите, как модель на 322M играет в Snake с видимым слоем безопасности цикла: реальные вероятности, измеренная задержка, 0 выходных токенов, без API вывода.
Бенчмарк API с одним вопросом: 7.39 ms p50 на M3 Max.
pip install laya-mlxКод, веса и воспроизводимые измерения: https://github.com/mizorewww/laya-mlx
Китайский черновик
Пусть модель выбирает направление напрямую, а не сначала генерирует текст.
Laya-MLX: открытые веса модели решений, работающие локально на Mac. В этом демо Snake с 322 миллионами параметров на каждом шаге показаны реальные вероятности направлений, время вывода и число перехватов слоем безопасности.
0 выходных токенов, без API вывода. Бенчмарк одного вопроса на M3 Max — P50 7.39 ms.
pip install laya-mlxКод, веса и исходный benchmark: https://github.com/mizorewww/laya-mlx
Отдельное последующее обновление по производительности
Оптимизированный полный цикл Snake измерил 75.40 ходов/секунду на 2 400 ходах, с нулём смертей, 2 вмешательствами безопасности и согласием 2 400/2 400 выполненных действий с парным eager-контролем. Это было примерно на 6.5% быстрее в том запуске. Сюда входят планирование, вывод, композиция Rich, сериализация ANSI и обновления игры, но исключена отрисовка эмулятора терминала.
Используйте отчёт об оптимизации при публикации этого числа. Заголовочные 7.39 ms описывают отдельную фикстуру API с одним вопросом; это не время кадра этого демо Snake с тремя вопросами. Ни один из результатов не является сравнением с облачным API или доказательством рассуждений Snake без помощи.