DeepDigest
Sakana AI · · ~3 мин

Sakana Namazu: LLM API для бизнеса в Японии

Sakana AI представила API Sakana Namazu — модель, адаптированную для работы с японским языком и бизнес‑контекстом Японии. Она основана на Kimi K2.6 от Moonshot AI и доработана Sakana AI. Модель успешно прошла ряд тестов и подходит для автоматизации бизнес‑процессов — от создания отчётов до поддержки клиентов. Доступ к API совместим с OpenAI.

LLM
Sakana Namazu: LLM API для бизнеса в Японии

Компания Sakana AI запустила API Sakana Namazu — специализированную большую языковую модель для работы с японским языком и бизнес-контекстом Японии. Модель представляет собой обновлённую версию той, что используется в Sakana Chat, и доступна через OpenAI-совместимый API.

Sakana Namazu основана на открытой модели Kimi K2.6 от Moonshot AI, но доработана с использованием внутренних данных Sakana AI. Её особенности включают:
* встроенные инструменты для веб‑поиска и выполнения кода;
* настройку для сокращения излишних отказов по некоторым темам;
* меры по снижению предвзятости в выводах.

Модель демонстрирует улучшенное качество ответов на японском языке и расширенные агентские возможности по сравнению с предыдущими версиями. Она предназначена для решения бизнес‑задач — сочетает приемлемую цену и совместимость с API OpenAI.

Чтобы оценить возможности Sakana Namazu, использовались разные бенчмарки:
* AIME26 — для оценки математических рассуждений;
* MMLU-Pro — для оценки широкого круга знаний и рассуждений;
* LiveCodeBench v6 — для оценки навыков программирования.

Модель успешно прошла и другие тесты. Например, она превзошла базовую модель в JFBench (этот бенчмарк разработан компанией Preferred Networks для оценки способности следовать инструкциям на японском языке). Для оценки в JFBench использовались выборки по 200 образцов для ограничений 1, 2, 4, 8. Также Sakana Namazu показала лучшие результаты в задаче перевода с японского на английский (с учётом специфических для Японии имён собственных и почтительной речи) и в FairPoliticsQA (оценивает нейтральность ответов). В FairPoliticsQA показатель вырос с 34,10 % до 56,30 %. Задачи перевода и FairPoliticsQA — собственные бенчмарки компании.

Среди практических применений модели:
* Автоматическое создание отчётов по рыночным исследованиям. Модель самостоятельно выполняет всю работу — от планирования до написания отчёта: ищет данные в интернете, перекрёстно проверяет информацию и готовит отчёт. Отчёт поступает, например, каждый понедельник утром.
* Автоматизация поддержки клиентов и анализ данных заказов. Модель обрабатывает запросы на японском языке, агрегирует и анализирует данные о заказах. Низкая стоимость использования позволяет объединить разрозненное применение ИИ в компании и сократить расходы.
* Автоматическое создание шоу с рыбками. Модели задаётся тема (например, «мир океана»), она выбирает мотив, ищет референсные изображения через веб‑поиск и составляет инструкции для движения около 1000 рыбок. На каждом шаге модель получает скриншот аквариума и самостоятельно выполняет цикл «просмотр — принятие решения — перемещение». В основе — функции, совместимые с OpenAI, и способность распознавать изображения.

Sakana AI рассматривает возможность расширения предложений для корпоративных клиентов. Чтобы задать вопросы по этому направлению, можно воспользоваться ссылкой .

Подробная техническая информация представлена в API Console, и . API Sakana Namazu можно изучить в Актуальные сведения о доступности модели — в API Console, а подробности — на страницах product page и Get-started. Вопросы о корпоративных внедрениях можно направлять через here. Стоимость использования модели описана в pricing page. Кроме того, Sakana AI ищет сотрудников для развития ИИ в Японии — подробности можно узнать в careers.

// оригинал
Sakana AI ↗ Читать оригинал
12 просмотров
// поделиться Telegram VK