Підказування з локальними файлами зображень
Ви працюєте дата-аналітиком у транспортному департаменті Лондона. Ваша команда створила візуалізацію, що показує кількість транспортних засобів на дорогах у різний час для різних видів транспорту, і ви хочете використати модель ШІ, щоб дістати з неї ключові інсайти.
Зображення збережено локально як "LDN_2024_traffic.png".
Автори зображення й даних: City Streets 2025 Summary Report by the City of London.
Ця вправа є частиною курсу
Робота з OpenAI Responses API
Інструкції до вправи
- Імпортуйте модуль
base64для кодування файла зображення. - Закодуйте файл зображення у base64 за допомогою функції
b64encode()зbase64, збережіть результат у зміннійimage_base64. - Доповніть повідомлення із введенням зображення в запиті, щоб вказати використання base64 та застосувати це кодування.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Import base64 module
____
# Encode the image file as base64
with open(image_path, "rb") as f:
image_base64 = base64.____(f.read()).decode("utf-8")
# Create a response with text and image input
response = client.responses.create(
model="gpt-5.4-mini",
input=[
{"role": "user", "content": [
{"type": "input_text", "text": "What mode of transport contributed the highest number of vehicles during business hours? Answer very concisely."},
{"type": "input_image", "image_url": f"data:image/png;____,{____}"}
]}
]
)
print(response.output_text)
visualize_image(image_url)