دوره آموزشی مبانی API اوپنایآی: ساخت اولین اپلیکیشن هوش مصنوعی
1 ساعت 10 دقیقهمبتدی2026-07-30
مدرسین

Kesha Williams
Software Engineering Manager, Speaker, Tech Blogger
جزئیات دوره
پلتفرم OpenAI مجموعهای از APIهای قدرتمند را برای ساخت برنامههای مبتنی بر متن، تصویر، صدا و جستوجوی معنایی در اختیار توسعهدهندگان قرار میدهد. این دوره با رویکردی کاملاً عملی، این قابلیتها را در قالب یک پروژه یکپارچه آموزش میدهد: ساخت یک ابزار جستوجوی دانش داخلی (Internal Knowledge Search Tool) که میتواند به پرسشهای کارکنان پاسخ دهد و از تولید متن، تحلیل تصویر، پردازش صوت، خروجی ساختاریافته و جستوجوی معنایی استفاده کند.
در مرکز دوره، Responses API قرار دارد. یاد میگیرید چگونه از یک نقطه ورود واحد برای تولید متن، تحلیل تصاویر و اسناد، فراخوانی توابع و تولید Structured Output استفاده کنید. سپس نحوه اتصال این API به دادههای خارجی از طریق Web Search، Custom Function Calling و Model Context Protocol (MCP) بررسی میشود تا برنامه بتواند اطلاعات موردنیاز خود را از منابع و سرویسهای خارج از سیستم نیز دریافت کند.
در بخش صوت، با Audio API کار میکنید و قابلیتهای Speech-to-Text برای تبدیل گفتار به متن و Text-to-Speech برای تبدیل متن به گفتار را در یک برنامه واقعی پیادهسازی میکنید. همچنین با Images API آشنا میشوید و یاد میگیرید چگونه از طریق Promptهای متنی، تصاویر تولید کنید.
یکی دیگر از محورهای مهم دوره، ساخت Semantic Search با استفاده از Embeddings API است. در این بخش یاد میگیرید چگونه اسناد را به نمایشهای برداری تبدیل کرده و به کاربران اجازه دهید پرسشهای خود را به زبان طبیعی مطرح کنند تا سیستم بتواند مرتبطترین اطلاعات را از میان اسناد بازیابی کند.
تمام کدها در GitHub Codespaces و با استفاده از APIهای واقعی اجرا میشوند. بنابراین در پایان دوره، صرفاً با مفاهیم نظری آشنا نخواهید بود؛ بلکه یک برنامه کاربردی و قابل توسعه در اختیار خواهید داشت که میتوانید آن را برای نیازهای تیم یا سازمان خود شخصیسازی کنید.
این دوره برای توسعهدهندگان و مهندسان نرمافزار مسلط به Python، افرادی با تجربه ساخت وباپلیکیشن یا ابزارهای داخلی، و همچنین رهبران فنی و معماران نرمافزار طراحی شده است که میخواهند قابلیتهای پلتفرم OpenAI را برای سازمان خود ارزیابی یا به کار بگیرند.
🎯 اهداف یادگیری
استفاده از Responses API برای تولید متن، تحلیل تصاویر، پردازش اسناد و فراخوانی توابع از طریق یک Endpoint
تولید خروجیهای ساختاریافته (Structured Output) برای استفاده مستقیم در برنامهها
اتصال Responses API به دادههای خارجی با استفاده از Web Search
استفاده از Custom Function Calling برای اتصال مدلهای هوش مصنوعی به قابلیتها و سرویسهای اختصاصی
اتصال مدلها و ابزارهای خارجی از طریق Model Context Protocol (MCP)
استفاده از Audio API برای تبدیل گفتار به متن و متن به گفتار در برنامههای کاربردی
تولید تصاویر از Promptهای متنی با استفاده از Images API
استفاده از Embeddings API برای تبدیل محتوا به نمایشهای برداری قابل جستوجو
ساخت سیستم Semantic Search برای بازیابی اسناد مرتبط از پرسشهای زبان طبیعی
پیادهسازی یک ابزار کاربردی جستوجوی دانش داخلی با استفاده از APIهای زنده OpenAI
در مرکز دوره، Responses API قرار دارد. یاد میگیرید چگونه از یک نقطه ورود واحد برای تولید متن، تحلیل تصاویر و اسناد، فراخوانی توابع و تولید Structured Output استفاده کنید. سپس نحوه اتصال این API به دادههای خارجی از طریق Web Search، Custom Function Calling و Model Context Protocol (MCP) بررسی میشود تا برنامه بتواند اطلاعات موردنیاز خود را از منابع و سرویسهای خارج از سیستم نیز دریافت کند.
در بخش صوت، با Audio API کار میکنید و قابلیتهای Speech-to-Text برای تبدیل گفتار به متن و Text-to-Speech برای تبدیل متن به گفتار را در یک برنامه واقعی پیادهسازی میکنید. همچنین با Images API آشنا میشوید و یاد میگیرید چگونه از طریق Promptهای متنی، تصاویر تولید کنید.
یکی دیگر از محورهای مهم دوره، ساخت Semantic Search با استفاده از Embeddings API است. در این بخش یاد میگیرید چگونه اسناد را به نمایشهای برداری تبدیل کرده و به کاربران اجازه دهید پرسشهای خود را به زبان طبیعی مطرح کنند تا سیستم بتواند مرتبطترین اطلاعات را از میان اسناد بازیابی کند.
تمام کدها در GitHub Codespaces و با استفاده از APIهای واقعی اجرا میشوند. بنابراین در پایان دوره، صرفاً با مفاهیم نظری آشنا نخواهید بود؛ بلکه یک برنامه کاربردی و قابل توسعه در اختیار خواهید داشت که میتوانید آن را برای نیازهای تیم یا سازمان خود شخصیسازی کنید.
این دوره برای توسعهدهندگان و مهندسان نرمافزار مسلط به Python، افرادی با تجربه ساخت وباپلیکیشن یا ابزارهای داخلی، و همچنین رهبران فنی و معماران نرمافزار طراحی شده است که میخواهند قابلیتهای پلتفرم OpenAI را برای سازمان خود ارزیابی یا به کار بگیرند.
🎯 اهداف یادگیری
استفاده از Responses API برای تولید متن، تحلیل تصاویر، پردازش اسناد و فراخوانی توابع از طریق یک Endpoint
تولید خروجیهای ساختاریافته (Structured Output) برای استفاده مستقیم در برنامهها
اتصال Responses API به دادههای خارجی با استفاده از Web Search
استفاده از Custom Function Calling برای اتصال مدلهای هوش مصنوعی به قابلیتها و سرویسهای اختصاصی
اتصال مدلها و ابزارهای خارجی از طریق Model Context Protocol (MCP)
استفاده از Audio API برای تبدیل گفتار به متن و متن به گفتار در برنامههای کاربردی
تولید تصاویر از Promptهای متنی با استفاده از Images API
استفاده از Embeddings API برای تبدیل محتوا به نمایشهای برداری قابل جستوجو
ساخت سیستم Semantic Search برای بازیابی اسناد مرتبط از پرسشهای زبان طبیعی
پیادهسازی یک ابزار کاربردی جستوجوی دانش داخلی با استفاده از APIهای زنده OpenAI
سرفصل ها
مقدمه
- پاسخها، ابزارها، جستوجو و صوت؛ هسته اصلی برنامه شما
شروع کار با Responses API
- تولید پاسخ از یک Prompt
- تحلیل اسکرینشاتها و اسناد
گسترش Responses API با ابزارها
- جستوجو در وب و دریافت پاسخهای ساختاریافته
- فراخوانی توابع اختصاصی خود
- دریافت مستندات از طریق MCP
- ارسال تدریجی پاسخها به کاربران
افزودن قابلیت صوتی و بصری
- تبدیل پرسشهای صوتی به متن با Audio API
- خواندن پاسخها با صدای بلند با Audio API
- تولید توضیحات بصری با Images API
قابل جستوجو کردن پایگاه دانش شما
- تبدیل اسناد به Embedding
- ساخت جستوجوی معنایی
- اجرای ابزار کامل جستوجوی دانش
نتیجهگیری
- گام بعدی چیست؟