Спустя восемнадцать месяцев после того, как Mira Murati ушла с поста CTO OpenAI, чтобы основать его, Thinking Machines Lab выпустила свою первую собственную модель. Inkling, представленная 15 июля, выходит с тем, чего не предлагают frontier-лаборатории: со всеми весами, под лицензией Apache 2.0.
Архитектура
Inkling — это 66-слойный decoder-only transformer на основе разреженной архитектуры mixture-of-experts — 256 routed experts плюс по два shared experts на слой, при этом активны шесть routed experts на каждый токен. В сумме это дает 975 миллиардов параметров, но лишь около 41 миллиарда активных на токен. Модель обучалась на 45 триллионах токенов, охватывающих текст, изображение, аудио и видео, на системах Nvidia GB300 NVL72, и поддерживает контекстное окно до 1 миллиона токенов. В карточке модели в качестве входов указаны текст, изображение и аудио, а на выходе — только текст; видео входит в обучающую смесь, но не в поверхность ввода.
Как ее запускать
Весы размещены на Hugging Face, вместе с NVFP4 quantized checkpoint для оборудования Blackwell. Запускать ее непросто: для BF16 требуется примерно 2TB of VRAM, для NVFP4 — около 600GB. Она поддерживается в Transformers, SGLang, vLLM, llama.cpp и Unsloth, доступна через TogetherAI, Fireworks, Modal, Databricks и Baseten, а также для дообучения на собственной платформе компании Tinker. Предварительная версия Inkling-Small — 276 миллиардов параметров в сумме, 12 миллиардов активных — использует тот же рецепт.
Необычно честный запуск
По данным компании, результаты Inkling составляют 97,1% на AIME 2026, 87,2% на GPQA Diamond, 77,6% на SWE-bench Verified и 46,0% на Humanity's Last Exam с инструментами; ни один из них не верифицирован независимо. Лаборатория утверждает, что Inkling использует в три раза меньше токенов, чем Nvidia's Nemotron 3 Ultra, при сопоставимой эффективности в кодинге. Но она отказывается от привычного заявления: "Inkling is not the strongest overall model available today, open or closed," — говорится в блоге.
Бизнес за этим
Основанная в February 2025, Thinking Machines привлекла в July 2025 $2 billion seed at a $12 billion valuation — крупнейший seed-раунд в истории ИИ — под руководством Andreessen Horowitz при участии Nvidia, Accel, ServiceNow, Cisco, AMD и Jane Street. Как сообщалось, последующий раунд, который пытались привлечь на $50 billion, к January 2026 сорвался без сделки: инвесторы хотели более убедительной продуктовой истории. Inkling — и есть эта история. Она не монетизируется; выручка поступает от Tinker, среди клиентов которого Bridgewater Associates.
