Створити

Нові моделі та продукти для розробників, анонс OpenAI DevDay

Це переклад допису з блогу OpenAI. Вичитати та зрозуміти і зробити вижимку це next-level, тому для спрощення доступу до інформації поки машинний переклад.


Про що в пості: GPT-4 Turbo з контекстом 128K і нижчими цінами, новий API Assistants, GPT-4 Turbo with Vision, DALL·E 3 API тощо.


GPT-4 Turbo з контекстом 128K

Ми випустили першу версію GPT-4 у березні, а в липні зробили GPT-4 загальнодоступним для всіх розробників. Сьогодні ми запускаємо попередню версію наступного покоління цієї моделі, GPT-4 Turbo.

GPT-4 Turbo є більш потужним і має інформацію про світові події до квітня 2023 року. Він має контекстне вікно на 128 тис. символів, що дозволяє вмістити еквівалент більш ніж 300 сторінок тексту в одній підказці. Ми також оптимізували його продуктивність, тому можемо запропонувати GPT-4 Turbo за ціною в 3 рази нижчою для вхідних токенів і в 2 рази нижчою для вихідних токенів порівняно з GPT-4.

GPT-4 Turbo доступний для всіх платних розробників, які можуть спробувати його, пройшовши попередню версію gpt-4-1106-preview в API, і ми плануємо випустити стабільну, готову до виробництва модель в найближчі тижні.

Оновлення виклику функцій

Виклик функцій дозволяє вам описувати функції вашого додатку або зовнішніх API моделям, а модель інтелектуально вибирає, як виводити JSON-об'єкт, що містить аргументи для виклику цих функцій. Сьогодні ми випускаємо кілька покращень, включаючи можливість виклику декількох функцій в одному повідомленні: користувачі можуть надсилати одне повідомлення із запитом на виконання декількох дій, наприклад, "відкрити вікно автомобіля та вимкнути кондиціонер", що раніше вимагало б декількох обходів моделі. Ми також покращуємо точність виклику функцій: GPT-4 Turbo з більшою ймовірністю повертає правильні параметри функції.

Покращене виконання інструкцій і режим JSON

GPT-4 Turbo краще, ніж наші попередні моделі, виконує завдання, які вимагають ретельного дотримання інструкцій, наприклад, генерування певних форматів (наприклад, "завжди відповідати у форматі XML"). Він також підтримує наш новий режим JSON, який гарантує, що модель відповідатиме коректним JSON. Новий параметр API response_format дозволяє моделі обмежувати свій вивід, щоб генерувати синтаксично правильний JSON-об'єкт. Режим JSON корисний для розробників, які генерують JSON в API завершення чату поза викликом функцій.

Відтворювані результати та ймовірності журналу

Новий параметр seed уможливлює відтворювані результати, змушуючи модель більшу частину часу повертати узгоджені завершення. Ця бета-версія корисна для таких випадків, як відтворення запитів для налагодження, написання більш повних модульних тестів і взагалі для отримання більш високого ступеня контролю над поведінкою моделі. Ми в OpenAI використовуємо цю функцію для власних юніт-тестів і вважаємо її безцінною. Ми з нетерпінням чекаємо, як розробники використають її.

У найближчі кілька тижнів ми також запускаємо функцію повернення ймовірностей журналу для найбільш ймовірних вихідних токенів, згенерованих GPT-4 Turbo і GPT-3.5 Turbo, яка буде корисною для створення таких функцій, як автозавершення в пошуку.

Оновлений GPT-3.5 Turbo

На додаток до GPT-4 Turbo, ми також випускаємо нову версію GPT-3.5 Turbo, яка за замовчуванням підтримує контекстне вікно розміром 16K. Нова версія 3.5 Turbo підтримує покращене відстеження інструкцій, режим JSON та паралельний виклик функцій. Наприклад, наші внутрішні оцінки показують 38% покращення у виконанні таких завдань, як генерація JSON, XML та YAML. Розробники можуть отримати доступ до цієї нової моделі, викликавши gpt-3.5-turbo-1106 в API. Додатки, що використовують ім'я gpt-3.5-turbo, будуть автоматично оновлені до нової моделі 11 грудня. Старіші моделі будуть доступні за викликом gpt-3.5-turbo-0613 в API до 13 червня 2024 року.

Assistants API, пошук та інтерпретатор коду

Сьогодні ми випускаємо Assistants API - наш перший крок до того, щоб допомогти розробникам створювати агентоподібні інтерфейси у власних додатках. Асистент - це спеціально створений штучний інтелект, який має певні інструкції, використовує додаткові знання і може викликати моделі та інструменти для виконання завдань. Новий API для асистентів надає нові можливості, такі як інтерпретатор коду та пошук, а також виклик функцій, щоб впоратися з великою кількістю важкої роботи, яку раніше доводилося виконувати самостійно, і дозволити вам створювати високоякісні програми зі штучним інтелектом.

Цей API розроблений для гнучкого використання: від програми для аналізу даних на основі природної мови до помічника з кодування, планувальника відпустки зі штучним інтелектом, діджея з голосовим керуванням, розумного візуального полотна - список можна продовжувати. Assistants API побудований на тих самих можливостях, що й наш новий продукт GPTs: користувацькі інструкції та інструменти, такі як інтерпретатор коду, пошук та виклик функцій.

Ключовою зміною в цьому API є постійні та нескінченно довгі потоки, які дозволяють розробникам передати управління станом потоку OpenAI та обійти обмеження контекстного вікна. За допомогою Assistants API ви просто додаєте кожне нове повідомлення до існуючого потоку.

Помічники також мають доступ до виклику нових інструментів за необхідності, зокрема

  • Інтерпретатор коду: пише і запускає код Python у середовищі виконання з пісочницею, може генерувати графіки і діаграми, а також обробляти файли з різноманітними даними і форматуванням. Він дозволяє вашим помічникам ітеративно запускати код для розв'язання складних програмних і математичних задач тощо.
  • Пошук: доповнює асистента знаннями з-поза меж наших моделей, такими як власні доменні дані (специфічні ніши), інформація про продукт або документи, надані вашими користувачами. Це означає, що вам не потрібно обчислювати і зберігати вбудовування для ваших документів або реалізовувати алгоритми розбиття на частини і пошуку. API асистентів оптимізує техніку пошуку, ґрунтуючись на нашому досвіді побудови пошуку знань у ChatGPT.
  • Виклик функцій: дозволяє асистентам викликати визначені вами функції та включати відповідь функції у свої повідомлення.

Як і у випадку з рештою платформи, дані та файли, передані до OpenAI API, ніколи не використовуються для навчання наших моделей, і розробники можуть видалити дані, коли вважатимуть за потрібне.

Ви можете спробувати бета-версію Assistants API без написання коду, перейшовши на Assistants playground.

Нові можливості в API

GPT-4 Turbo з функцією технічного зору

GPT-4 Turbo може приймати зображення як вхідні дані в API доповнення чату, що дозволяє використовувати його для створення підписів, детального аналізу реальних зображень і читання документів з малюнками. Наприклад, BeMyEyes використовує цю технологію, щоб допомогти незрячим або слабозорим людям виконувати повсякденні завдання, такі як ідентифікація товару або навігація в магазині. Розробники можуть отримати доступ до цієї функції, використовуючи gpt-4-vision-preview в API. Ми плануємо додати підтримку зору до основної моделі GPT-4 Turbo в рамках її стабільного релізу. Ціна залежить від розміру вхідного зображення. Наприклад, передача зображення з роздільною здатністю 1080×1080 пікселів до GPT-4 Turbo коштує $0,00765. Ознайомтеся з нашою інструкцією.

DALL-E 3

Розробники можуть інтегрувати DALL-E 3, який ми нещодавно запустили для користувачів ChatGPT Plus і Enterprise, безпосередньо в свої програми і продукти через наш Images API, вказавши dall-e-3 в якості моделі. Такі компанії, як Snap, Coca-Cola і Shutterstock, використовують DALL-E 3 для програмної генерації зображень і дизайну для своїх клієнтів і кампаній. Як і попередня версія DALL-E, API включає вбудовану модерацію, щоб допомогти розробникам захистити свої програми від неправомірного використання. Ми пропонуємо різні варіанти формату та якості, а ціни починаються від $0,04 за створене зображення. Ознайомтеся з нашим посібником з початку роботи з DALL-E 3 в API.

Перетворення тексту в мову (TTS)

Розробники тепер можуть генерувати мову людської якості з тексту за допомогою API перетворення тексту в мову. Наша нова модель TTS пропонує шість попередньо встановлених голосів на вибір і два варіанти моделі, tts-1 і tts-1-hd. tts оптимізована для використання в режимі реального часу, а tts-1-hd оптимізована для якості. Ціна починається від $0,015 за введення 1,000 символів. Ознайомтеся з нашим посібником з TTS, щоб почати роботу.

Налаштування моделі
Експериментальний доступ для точного налаштування GPT-4
Ми створюємо програму експериментального доступу для точного налаштування GPT-4. Попередні результати показують, що тонка настройка GPT-4 вимагає більше роботи для досягнення значних поліпшень порівняно з базовою моделлю, порівняно з істотними виграшами, отриманими при тонкій настройці GPT-3.5. По мірі покращення якості та безпеки точного налаштування GPT-4 розробникам, які активно використовують точне налаштування GPT-3.5, буде надано можливість перейти до програми GPT-4 у своїй консолі точного налаштування.

Спеціальні моделі
Для організацій, які потребують ще більшої кастомізації, ніж може забезпечити тонка настройка (особливо це стосується доменів з надзвичайно великими власними наборами даних - мільярди токенів як мінімум), ми також запускаємо програму "Кастомні моделі", що надає обраним організаціям можливість працювати зі спеціальною групою дослідників OpenAI, щоб підготувати кастомний GPT-4 для їх конкретного домену. Це включає в себе модифікацію кожного кроку процесу навчання моделі, від проведення додаткового попереднього навчання для конкретного домену до запуску спеціального процесу RL після навчання, пристосованого для конкретного домену. Організації матимуть ексклюзивний доступ до своїх власних моделей. Відповідно до нашої існуючої корпоративної політики конфіденційності, кастомні моделі не будуть надаватися або передаватися іншим клієнтам, а також використовуватися для навчання інших моделей. Крім того, власні дані, надані OpenAI для навчання користувацьких моделей, не будуть повторно використовуватися в будь-якому іншому контексті. Це буде дуже обмежена (і дорога) програма, до якої можуть приєднатися зацікавлені організації.

Нижчі ціни та вищі ліміти

Нижчі ціни

  • Ми знижуємо кілька цін на всій платформі, щоб передати економію розробникам (всі ціни нижче вказані за 1,000 токенів):
  • Вхідні токени GPT-4 Turbo в 3 рази дешевше, ніж GPT-4, на $0.01, а вихідні токени в 2 рази дешевше, на $0.03.
  • Вхідні токени GPT-3.5 Turbo в 3 рази дешевші за попередню модель 16K - $0,001, а вихідні токени в 2 рази дешевші - $0,002. Розробники, які раніше використовували GPT-3.5 Turbo 4K, можуть скористатися 33% знижкою на вхідні токени за ціною $0,001. Ці нижчі ціни застосовуються лише до нового GPT-3.5 Turbo, представленого сьогодні.
  • Вартість вхідних токенів моделі GPT-3.5 Turbo 4K знижена в 4 рази до $0,003, а вихідних токенів - в 2,7 рази до $0,006. Нова модель GPT-3.5 Turbo також підтримує контекст 16K за тією ж ціною, що і 4K. Ці нові ціни також застосовуються до моделей gpt-3.5-turbo-0613 з тонким налаштуванням.

GPT-4 Turbo

  • GPT-4 8K Вхід: $0.03 Вихід: $0.06
  • GPT-4 32K Вхід: $0.06 Вихід: $0.12
  • Нова модель: GPT-4 Turbo 128K Вхід: $0.01 Вихід: $0.03

GPT-3.5 Turbo

  • GPT-3.5 Turbo 4K Вхід: $0.0015 Вихід: $0.002
  • GPT-3.5 Turbo 16K Вхід: $0.003 Вихід: $0.004
  • Нова модель: GPT-3.5 Turbo 16K Вхід: $0.001 Вихід: $0.002

GPT-3.5 Turbo fine-tuning

  • GPT-3.5 Turbo 4K fine-tuning Training: $0.008 Вхід: $0.012 Output: $0.016
  • Нова модель: GPT-3.5 Turbo 4K та 16K fine-tuning Training: $0.008 Вхід: $0.003 Вихід: $0.006

Підвищені ліміти на швидкість

Щоб допомогти вам масштабувати ваші додатки, ми подвоюємо ліміт токенів за хвилину для всіх наших платних користувачів GPT-4. Ви можете переглянути свої нові ліміти на сторінці лімітів. Ми також опублікували наші рівні використання, які визначають автоматичне збільшення лімітів, щоб ви знали, чого очікувати від автоматичного масштабування ваших лімітів використання. Тепер ви можете запросити збільшення лімітів використання в налаштуваннях свого облікового запису.

Захист авторських прав

OpenAI прагне захистити наших клієнтів за допомогою вбудованих засобів захисту авторських прав у наших системах. Сьогодні ми робимо ще один крок вперед і впроваджуємо функцію захисту авторських прав - тепер ми будемо захищати наших клієнтів і оплачувати понесені витрати, якщо ви зіткнетеся з юридичними претензіями, пов'язаними з порушенням авторських прав. Це стосується загальнодоступних функцій ChatGPT Enterprise і нашої платформи для розробників.

Whisper v3 та декодер узгодженості

Ми випускаємо Whisper large-v3, наступну версію нашої моделі автоматичного розпізнавання мови (ASR) з відкритим вихідним кодом, яка має покращену продуктивність на різних мовах. Ми також плануємо підтримати Whisper v3 у нашому API найближчим часом.

Ми також відкриваємо відкритий код декодера узгодженості, який замінить декодер стабільної дифузії VAE. Цей декодер покращує всі зображення, сумісні зі Stable Diffusion 1.0+ VAE, зі значним покращенням тексту, облич та прямих ліній.


Повну точну версію статі читайте в блозі OpenAI.

13 коментарів

Увійдіть, щоб коментувати.
2 бали
Поскаржитись

@sumni3bochennia Там тусується купа жінок-домохозяйок. :) Там не потрібен бот.

2 бали
Поскаржитись

@lemmy а також срачі на різноманітні суспільно-політичні теми

1 бал
Поскаржитись

@lemmy Думаєш на порадниці тусується бот-нейромережа?

1 бал
Поскаржитись

@javascript гагагаггаа, бля

1 бал
Поскаржитись

@himarstime Я думаю, що в нас заходять більш технічні питання типу "як змайструвати", "як встановити", "як полагодити", "як досягти". Питання на взаємодію з реальним світом і його підлаштуванням під себе.

1 бал
Поскаржитись

@himarstime Так, чоловіки схильні це тримати в собі, а жінки цим діляться і шукають підтримку серед людей. :) Не думаю, що це суіцідальні питання, скоріше навпаки – питання які націлені на розвʼязання проблеми і полегшенні самопочуття.

1 бал
Поскаржитись

@himarstime Та ну, наведи приклади. Звісно є різне, але там жіноча аудиторія – більш емоційна та схильна до перебільшень.

1 бал
Поскаржитись

@lemmy не суціальні, а суіцидальні

1 бал
Поскаржитись

@javascript Я подивився на https://sovet.kidstaff.com.ua/ – там більше про спілкування ніж про статі. Тобто статті це гарне доповнення, але на "Порадниці" більшість контенту це різноманітна інформація про суціальні питання від звичайних людей, буденні проблеми, наприклад "ситуація на рінку праці", "гарний філь на вечір" і тому подібне.