Стартап Anthropic оголосив про запуск нових моделей штучного інтелекту — Claude Opus 4 та Claude Sonnet 4, що входять до нового сімейства Claude 4. Як заявляє компанія, нові моделі здатні виконувати складні завдання, опрацьовувати великі масиви даних і демонструють високі результати у бенчмарках програмування.
Sonnet 4 буде доступна як платним, так і безкоштовним користувачам, тоді як Opus 4 — лише за підпискою, – інформує видання TechCrunch.
Моделі Claude 4 позиціонуються як гібридні — поєднують швидкі відповіді з можливістю глибокого розмірковування. У цьому режимі користувач отримує зведення логіки міркувань, а сам процес дозволяє моделі шукати точніші рішення.
Opus 4 здатна виконувати довгі багатокрокові завдання з послідовною логікою — від програмування до аналізу складних даних. У тестах компанії вона перевершила Gemini 2.5 Pro, GPT-4.1 і OpenAI o3 на бенчмарку SWE-bench Verified (оцінювання навичок у програмуванні), хоча не змогла випередити o3 на тестах MMMU або GPQA Diamond (PhD-рівень із фізики, біології, хімії).
Разом із моделями Anthropic також представила оновлення інструмента Claude Code. Відтепер він інтегрується з IDE (Visual Studio Code, JetBrains) і GitHub, підтримує SDK для створення AI-кодинг-асистентів. Claude Code також здатний відповідати на фідбек рев’юерів та автоматично редагувати код.
Моделі працюють із зовнішніми інструментами, зберігають факти у «пам’яті» для формування стійких знань і оснащені посиленими системами захисту від шкідливого контенту. Opus 4 має статус ASL-3 — це означає, що вона потенційно може бути використана в небезпечних STEM-сценаріях, зокрема для розробки біологічної або хімічної зброї, тож модель постачатиметься з додатковими обмеженнями.
Читайте також матеріал видання GALERA про те, як штучний інтелект змінює програмування.