English

ШІ

ШІ-асистент для малого бізнесу: ми перевірили три моделі на п'яти українських задачах

Порівняння ШІ-асистентів зазвичай пишуть за списком функцій. Ми дали трьом моделям п'ять задач, які власник малого бізнесу ставить щотижня, і звірили відповіді з еталоном.

Оновлено 2026-10-06 8 хв Цифри з датою перевірки
Ілюстрацію згенеровано ШІ (OpenAI gpt-image-1) і позначено метаданими IPTC.

Як ми тестували

Ми взяли п'ять задач, які власник невеликого бізнесу реально дає ШІ-асистенту, і для кожної заздалегідь записали, яка відповідь правильна:

  1. Лист клієнтці, у якої подарунок не встиг до дня народження доньки. Перевіряємо дату, тон і чи не вигадує асистент фактів та компенсацій.
  2. Опис товару — дитячої гірки — до 600 знаків із шести характеристик. Перевіряємо, чи всі характеристики на місці і чи не з'явились вигадані.
  3. Ризики в договорі поставки. У чотири пункти ми заклали чотири пастки для постачальника.
  4. Середній чек і маржа за два місяці. Правильні числа відомі.
  5. Ліміт доходу ФОП 3 групи на 2026 рік і що буде після перевищення в травні. Еталон — наша стаття про ліміт ФОП, звірена з Податковим кодексом.

Учасники — три моделі двох компаній: платна флагманська GPT-5.5 від OpenAI і дві швидкі — GPT-5.4 mini від OpenAI та Gemini 3.5 Flash від Google. Усі відповідали через API, без пошуку в інтернеті, з налаштуваннями за замовчуванням, по одній спробі на задачу.

Двох важливих учасників у тесті немає. Claude від Anthropic ми не тестували: редакція працює з ним сама, і оцінювати його за власними критеріями було б конфліктом інтересів. Gemini 3.1 Pro у безкоштовному доступі до API недоступна, тож від Google у тесті швидка модель.

Результати

Як три моделі впорались із п'ятьма задачами
Лист клієнтці✓ точно й коротко✓ точно й коротко✗ вигадала факти й компенсації
Опис товару✓ 6 з 6✓ 6 з 6≈ 6 з 6, але «гіпоалергенний лак»
Ризики в договорі✓ 4 з 4✓ 4 з 4≈ 4 з 4, дві хибні правові тези
Середній чек і маржа✓ усе правильно✓ усе правильно✓ усе правильно
Ліміт ФОП 2026✓ 3 з 3✗ застарілий ліміт✗ застарілий ліміт

✓ — відповідає еталону; ≈ — задачу виконано, але з помилкою, яку треба виправляти вручну; ✗ — відповідь не можна використати без переробки.

Розрахунок усі три зробили без помилок: середній чек 450 і 420 гривень, маржа 40% і 39%, кількість чеків упала на 12%. Усі три також помітили головне — чек зріс, а покупців поменшало. Це той самий випадок, який ми розбирали в статті про середній чек.

Податки: де помиляються дешеві моделі

Ліміт доходу ФОП 3 групи на 2026 рік — 10 091 049 гривень: 1 167 мінімальних зарплат по 8 647 гривень. Саме це число назвала GPT-5.5, разом із правильними наслідками: 15% податку з суми перевищення і перехід на загальну систему з 1 липня.

Дві швидкі моделі назвали інші числа:

  • GPT-5.4 mini — 8 285 700 гривень. Формула правильна, але мінімальна зарплата взята 7 100 гривень, тобто рівня 2024 року. Модель ще й порадила «перейти на іншу групу», хоча вище третьої групи переходити нікуди.
  • Gemini 3.5 Flash — 9 336 000 гривень, з мінімальною зарплатою 8 000 гривень, і додала, що бюджет на 2026 рік ще не ухвалено. Решту наслідків — 15%, 1 липня, заява до 20 липня — описала правильно.

Механізм помилки простий: модель відповідає з пам'яті, а пам'ять у неї станом на дату навчання. Формулу вона знає, а свіжу мінімальну зарплату — ні. Тому відповідь звучить переконливо й містить правильні слова, але число в ній застаріле. Для власника бізнесу це найнебезпечніший тип помилки: його не видно без перевірки.

Вигадані деталі в текстах для клієнтів

У листі клієнтці Gemini 3.5 Flash написала, що посилка «застрягла» і що повторна відправка йде «за наш рахунок», — жодного з цих фактів в умові не було. Крім того, вона запропонувала додати знижку або подарунок, хоча магазин нічого такого не обіцяв. Пропозицію позначено як варіант, але відповідь на 903 знаки замість короткої треба переписувати перед відправленням.

В описі товару та сама модель назвала лак «гіпоалергенним». В умові був лише «лак на водній основі». Моделі OpenAI додали м'якше «безпечний для дітей» — теж оцінка, якої не було в даних, але без конкретної властивості, яку можна перевірити.

Для бізнесу різниця суттєва. Обіцянка в листі клієнту стає зобов'язанням, а властивість в описі товару — підставою для претензії.

Договір: пастки знаходять, на закони посилаються невірно

У договір ми заклали чотири пастки для постачальника: оплата через 90 банківських днів, пеня 1% на день від вартості всього договору без верхньої межі, суд за місцезнаходженням покупця і автоматичне продовження з повідомленням за 90 днів. Усі три моделі знайшли всі чотири й запропонували розумні правки.

Але Gemini 3.5 Flash додала дві правові тези, які не витримують перевірки:

Моделі OpenAI на конкретні статті законів не посилались. Відповідь GPT-5.5 була найповнішою, але й найдовшою — майже 8 000 знаків на чотири пункти договору.

Як цим користуватись

  1. Розрахунки й структуровані задачі — можна віддавати будь-якій із трьох моделей. Перевіряйте вибірково.
  2. Числа, які змінюються щороку — ліміти, ставки, мінімальна зарплата — ніколи не беріть із відповіді моделі без першоджерела. Якщо у вашому асистенті є пошук в інтернеті, вмикайте його для таких питань, але й тоді звіряйте з сайтом податкової чи текстом закону.
  3. Тексти для клієнтів перечитуйте з одним питанням: чи не з'явилось тут обіцянки або факту, яких ви не давали.
  4. Договори — використовуйте асистента як чекліст ризиків, а не як юриста. Посилання на закони перевіряйте на zakon.rada.gov.ua: там видно, чи норма чинна.

Наша позиція

Для малого бізнесу різниця між платною флагманською моделлю і безкоштовною швидкою — не в стилі тексту, а в тому, чи можна вірити свіжим фактам. Якщо ви ставите асистенту питання про податки, право чи державні програми, платна модель з пошуком в інтернеті окупиться, щойно вбереже вас від однієї помилки в декларації.

Позиція не діє, якщо ви використовуєте асистента лише для чернеток, розрахунків і листування, де всі факти даєте самі. Тут, за нашим тестом, швидкі моделі справляються не гірше: GPT-5.4 mini впоралась з усіма п'ятьма задачами за 23 секунди, а GPT-5.5 — за 83.

Методологія і промпти

Тест проведено 6 жовтня 2026 року. Моделі: gpt-5.5-2026-04-23, gpt-5.4-mini-2026-03-17 (OpenAI Responses API) і gemini-3.5-flash (Gemini API). Gemini 3.8 Flash у день тесту не відповідала через перевантаження, Gemini 3.1 Pro недоступна на безкоштовному рівні API. Одна спроба на задачу, без системних інструкцій і без пошуку в інтернеті. Відповіді у застосунках ChatGPT і Gemini можуть відрізнятися: там є пошук і власні налаштування.

Оцінка спирається на перевірювані критерії: правильні числа, кількість знайдених закладених ризиків, наявність фактів, яких не було в умові. Статус законів звірено на zakon.rada.gov.ua того ж дня.

Тексти всіх п'яти завдань
  1. «Клієнтка Ольга написала в чат нашого інтернет-магазину «Дерево і Ко»: «Замовила 28 вересня подарунок до дня народження доньки на 3 жовтня, посилки досі немає, я дуже розчарована». Затримка сталася з вини перевізника. Ми сьогодні відправляємо замовлення повторно експресом, воно буде в неї 8 жовтня. Напиши відповідь від магазину українською: коротко, по-людськи, без шаблонних вибачень.»

  2. «Напиши опис для картки товару в інтернет-магазині. Товар: дерев'яна дитяча гірка Монтессорі. Матеріал — береза. Розміри — 120×45×60 см. Навантаження — до 30 кг. Вік — від 1 до 4 років. Складається для зберігання. Покриття — лак на водній основі. Обсяг — до 600 знаків. Пиши українською.»

  3. «Я постачальник, мені надіслали договір поставки. Ось чотири пункти з нього: 4.2. Оплата здійснюється протягом 90 банківських днів з моменту підписання видаткової накладної. 6.1. За прострочення поставки Постачальник сплачує пеню в розмірі 1% від загальної вартості Договору за кожен день прострочення. 7.4. Усі спори між сторонами розглядаються в суді за місцезнаходженням Покупця. 9.3. Договір автоматично продовжується на кожен наступний календарний рік, якщо жодна зі сторін не повідомила іншу про його розірвання не пізніше ніж за 90 днів до закінчення строку дії. Які з цих пунктів для мене ризиковані і що запропонувати змінити? Відповідай українською.»

  4. «Ось продажі мого магазину. Вересень: 1 240 чеків, виручка 558 000 грн, собівартість проданих товарів 334 800 грн. Серпень: 1 410 чеків, виручка 592 200 грн, собівартість 361 242 грн. Порахуй середній чек і валову маржу у відсотках за кожен місяць і коротко поясни, що змінилося і на що мені звернути увагу. Відповідай українською.»

  5. «Я ФОП 3 групи, не платник ПДВ. Який у мене ліміт доходу на 2026 рік і що станеться, якщо я перевищу його в травні 2026 року? Відповідай українською, коротко і конкретно.»

Не певні, що це ваш випадок?

Опишіть ситуацію. Перша відповідь скаже, наша це задача чи ні, і скільки триває діагностика.

Запросити діагностику