Claude Sonnet 5: Як новий штучний інтелект змінює підхід до складних завдань
Компанія Anthropic нещодавно відкрила доступ до Claude Sonnet 5, що стало справжньою подією у світі штучного інтелекту. Хоча на перший погляд модель мало чим відрізняється від вже відомих Gemini або ChatGPT при стандартних запитах, справжня міцність її – у роботі зі складними багатокроковими завданнями. Цей ШІ не просто надає інформацію — він здатен організувати рішення там, де потрібна глибока аналітика та комплексний підхід.
Розробники позиціонують Claude Sonnet 5 як інструмент для багатоступеневого програмування, тривалого написання коду, роботи з різноманітними інструментами, налагодження й орієнтації у складних технічних середовищах. Окрім цього, модель вміє планувати дії, користуватися браузерами й терміналами, виконуючи завдання з набагато більшою автономністю, ніж її попередники.
Плануємо сімейний вікенд у Баті: перші враження від Sonnet 5
Замість програмування я вирішив випробувати модель у повсякденній задачі — організації сімейної поїздки до Бат. До поїздки були: двоє дорослих і двоє підлітків.
Для Claude Sonnet 5 я поставив кілька конкретних завдань:
- Скласти детальний план вихідних із перельотом, обідом і однією активністю;
- Оціни приблизний бюджет поїздки;
- Визначити, що потрібно бронювати заздалегідь.
Модель почала з узагальненого огляду, визначила, які моменти реалізує сама, а де потрібна допомога користувача чи додаткові інструменти. Далі — приступила до опрацювання максимальної частини завдання самостійно.
Що отримали в результаті?
План виявився надзвичайно розгорнутим: кілька варіантів подорожі, детальний розклад, рекомендації щодо місць для обіду та екскурсії, а також інтерактивна карта з позначенням важливих локацій. До того ж Sonnet 5 представив список виконаних дій, подальші кроки і моменти, які залишаються на розсуд користувача.
Фішки інтерактивності: прогноз погоди та більше
Коли я уточнив дату поїздки, отримав ще й візуальний прогноз погоди — приємний бонус, який додає комфорту у співпраці зі штучним інтелектом. Такий підхід робить процес планування більш повним і зручним.
Claude Sonnet 5 vs ChatGPT: як вони справляються з організацією подорожі
Щоб порівняти можливості, я також звернувся до ChatGPT-5.5 Medium із таким самим завданням. Обидва ШІ швидко зорієнтувалися в ролі помічників та повідомили про виконання завдань. Проте ChatGPT обмежився текстовим звітом без графіків чи карт, що робило інтерфейс менш інтерактивним.
Рекомендації у обох були схожі: обід і візит до Римських ванн. Відмінність була у транспорті: ChatGPT пропонував поїздку потягом, Claude — автомобілем. Місця для харчування теж відрізнялися, однак загальний рівень інформації залишався високим.
Цікаво, що обидві моделі швидко адаптувалися до змін у запитах — змінювали вік дітей, враховували студентський статус, змінювали дату та транспорт. Зокрема були враховані особливості, як-от безкоштовний вхід для старшого студента на атракції.
Новий виклик: створення бюджетного трекера для дому
Щоб перевірити узгодженість роботи і у зовсім іншій сфері, я попросив обидва ШІ створити простий бюджетний трекер — таблицю або інструмент для контролю витрат.
Обидва продемонстрували добре опрацьовані варіанти:
- ChatGPT підготував таблицю з діаграмою, що порівнює витрати з бюджетом;
- Claude акцентував увагу на відстеженні фактичних витрат із секторною діаграмою, яка наочно ілюструє розподіл коштів.
У Claude також були приємні дрібниці, як кнопка для швидкого завантаження файлу у Google Drive, що помітно спрощувало користування. Інтерпретувати дані вийшло дуже легко.
Обидві системи оперативно реагували на побажання змінити вигляд діаграми або додати нові розділи — ChatGPT швидко перейшов на кругову діаграму, а Claude додав бар-чарти для більш детального бюджету. Обидва відкриті до доопрацювань і чітко пояснюють кожен наступний крок.
Погляд у майбутнє: що чекає ШІ-помічників?
Наразі головний акцент у порівнянні — не в тому, хто відповідає краще, а хто більше допомагає довести справу до кінця, враховуючи всі нюанси. Claude Sonnet 5 вирізняється тим, що спрямований не просто давати відповіді, а виконувати завдання комплексно і послідовно.
Від ШІ очікують не просто інформації, а справжнього партнерства у роботі: щоб програма не залишала відкритих питань, зрозуміло викладала результати й могла автономно працювати далі. Хоча поки жоден із доступних помічників не бере на себе повний процес — бронювання чи фінальне оформлення — тенденції розвитку очевидні: шлях лежить у сторону максимальної зручності, ефективності та автономності моделей.