Без Fable 5 обійдемося: Sakana AI заявляє, що Fugu бере ті самі планки
Японський стартап Sakana AI представив Fugu — систему мультиагентної оркестрації. Флагманська версія Fugu Ultra, за твердженням компанії, порівнянна за якістю з моделями Anthropic Fable і Mythos, доступ до яких обмежено експортними правилами.
Як влаштований Fugu
Fugu — велика мовна модель, яка звертається до пулу інших моделей-агентів і може рекурсивно викликати саму себе. Користувач надсилає один запит, а вибір виконавця, делегування та зведення результату система бере на себе.
Продукт постачається у двох варіантах через єдиний API, сумісний з OpenAI. Базовий Fugu розрахований на щоденні завдання та меншу затримку; флагманський Fugu Ultra координує ширший пул агентів для складних сценаріїв — наприклад, досліджень у сфері ШІ та аналізу кібербезпеки.
Запуск відбувся після того, як 12 червня Anthropic призупинила доступ до Fable 5 і Mythos 5: американська директива про експортний контроль послалася на національну безпеку й закрила доступ іноземним громадянам.
Ставка на суверенний ШІ
Команда Sakana AI стверджує, що залежність держави або бізнесу від ШІ єдиного постачальника в критично важливих системах — це «суттєва вразливість», і що загроза вже перейшла з теорії у практику.
«Як ми бачили на прикладі нещодавніх експортних обмежень для моделей на кшталт Fable і Mythos, доступ може зникнути за одну ніч. Колективний інтелект — практичний захист від такої концентрації влади. Оскільки Fugu оркеструє пул взаємозамінних агентів, він просто обходить обмеження постачальників. Оркеструючи моделі всього світу, ми пропонуємо стійкий проєкт, необхідний для справжнього суверенітету у сфері ШІ», — заявили в компанії.
Бенчмарки: результат неоднозначний
Sakana порівняла Fugu з Fable 5, Mythos Preview, Gemini 3.1 Pro, GPT 5.5 та Opus 4.8. Повної переваги не вийшло: Fugu Ultra лідирував у чотирьох тестах із восьми, зокрема LiveCodeBench (93,2) і GPQA-D (95,5). Fable 5 переміг у трьох — у SWEBench Pro (80,0 проти 73,7 у Fugu Ultra), а також у SciCode та Humanity’s Last Exam; Opus 4.8 випередив решту в CTI-REALM. У порівнянні з Mythos Preview Fugu Ultra виграв усі спільні бенчмарки, але з відривом менш ніж один пункт.
Компанія також показала прикладні демонстрації. У тесті автономного машинного навчання Fugu Ultra провів понад 100 експериментів за 14 годин на одному GPU H100 і, за словами команди, показав найкращий середній результат серед усіх базових моделей. Інші демонстрації стосувалися трейдингу, шахів і дизайну.
Джерело: BeInCrypto
Новини у світі криптовалют
Випадкова цитата про гроші
"Надо покупать соразмерно выгоде и убытку. Если не хочешь разориться, не трать не поступивших доходов."














* для пошуку по базі проксі просто вводьте назву країни, наприклад: Росія, США, Таїланд