Який чатбот найкраще підсумує день листування: тест трьох гігантів штучного інтелекту
Вибір ідеального AI-асистента для роботи з електронною поштою завжди був непростим. Адже, поки ви переймаєтеся одним сервісом, інший вже встиг випустити нову, вдосконалену модель. Ще складніше, що кожен ШІ краще справляється з різними завданнями. Тому ми вирішили дізнатися, який із трьох найпопулярніших чат-ботів найкраще підсумує цілу добу листування у Gmail.
Передача листів: анонімність — понад усе
Навіщо AI-ботам знати мої особисті дані?
Обрав випадковий день і за допомогою скрипта Google Apps Script експортував усі листи з Gmail за цей період у текстовий файл. Це, на мою думку, найшвидший спосіб отримати необроблений текст для подальшого використання будь-яким із чатботів.
Хоча всі три сервіси дозволяють прямо підключати Gmail і мати доступ до листів (логічно для Gemini, адже він — рідний продукт Google, а ChatGPT і Claude мають офіційні конектори), я не хотів довіряти їм повний доступ до приватної інформації. Тому експортування та анонімізація листів здалися найбезпечнішим вибором.
Для приховання особистих даних я скористався Python-скриптом, що замінював імена й адреси. Останній вручну прибрав те, що скрипт міг пропустити. Коли переконався, що всі особисті відомості видалено, передав той самий текст кожному чатботу з таким запитом:
Підсумуй листи цього дня за категоріями:
1. Термінові дії, які потрібно виконати
2. Важлива інформація для ознайомлення
3. Повідомлення, які можна безпечно ігнорувати
4. Хронологічний список дедлайнів, зустрічей і обіцяних відповідей
Вказуй відправника і тему для кожного пункту. Не вигадуй інформації. Якщо щось незрозуміло — згадай про це.
Gemini: майже всю важливу інформацію пропустив
Найгірший результат серед трьох
Здавалось би, власна AI-модель Google мала б блискуче справлятися з листами у Gmail, але це далеко не так. Результати були мізерними та дуже розчарували.
Я використав модель Gemini 3.5 Flash, позиційовану як універсальний помічник, проте відповідь була мінімалістичною і практично марною.
Gemini заявив, що термінових дій немає, хоча в листуванні про перенесення уроку піаніно залишались невирішені питання, що потребували негайної відповіді. Крім того, у плані майбутнього платежу також потрібно було вжити заходів. Обидва моменти він пропустив.
Хоча тема уроку піаніно згадувалась у блоці “Важлива інформація”, там лише повторювали факти без наголошення на необхідності відповіді. Про майбутній платіж в жодному разі не згадано, навіть серед “Повідомлень, які можна ігнорувати”.
Якби я довірив підсумки Gemini, донька, ймовірно, пропустила б урок, а я — платіж, що міг спричинити проблеми.
ChatGPT помітив дещо, але пропустив багато
Виявив лише дві корисні деталі
Наступним був ChatGPT на базі GPT-5.5 Instant — режим за замовчуванням для стандартної бесіди. Відчувалося, що це більш справедливе порівняння з Gemini.
ChatGPT відзвітував краще: знову термінових дій не назвав, тож недооцінив урок піаніно і майбутній платіж. Проте звернув увагу на платіж від родича й доставку з Amazon, що справді корисна інформація.
На жаль, про тему уроку піаніно в багатолиственному ланцюжку листів він не згадав зовсім, навіть серед тієї інформації, яку можна було пропустити.
Отже, в разі покладання на ChatGPT без особистого перегляду листів, були б ті самі ризики — пропущений урок і непомічений рахунок.
Claude став беззаперечним лідером
Модель Anthropic не пропустила жодної важливої деталі
Вже починав сумніватися у загрозах AI для наших робочих місць, адже ці популярні моделі не впоралися навіть із простим завданням — підсумовуванням пошти. Та залишився останній варіант — Sonnet 5 від Claude, призначений для буденних завдань.
На щастя, Claude чудово впорався. Він виявив два термінові дії: по-перше, те саме листування про урок піаніно, зазначивши, що потрібна негайна відповідь для уточнення часу.
Крім того, Claude не забув про майбутній платіж, вказав дату і навіть порадив уточнити суму в компанії, адже в даних було зазначено “невідомо”.
Доповнив це згадками про платіж від родича, доставку Amazon і навіть виявив ще один рахунок у “Важливій інформації”. Також детально розподілив листи, які можна ігнорувати, відокремивши переважно маркетингові розсилки.
Таким чином, Claude продемонстрував найповніший і найнадійніший звіт, який я очікував від будь-якого з чатботів.
У кожного AI – свої “фішки”
Це не означає, що слід одразу скидати Gemini чи ChatGPT. Тестування було дуже вузьким і зосередженим лише на одному завданні. У інших ситуаціях Claude може поступатися, наприклад, нечитанням контенту з Reddit, що доступний для інших ботів.
Проте саме у підсумовуванні імейлів Claude виявився найпрофесійнішим та найкориснішим помічником.