الذكاء الاصطناعي والـ models
Inference
اللحظة التي يعمل فيها الـ model فعليًّا لإنتاج إجابة — «تفكيره» استجابةً لمدخلاتك. إنه الطرف المقابل للـ training: فالـ training هو العملية الطويلة، لمرّة واحدة، التي تعلّم فيها الـ model، أمّا الـ inference فهو كلّ تشغيل سريع لاحق يوظّف فيه ذلك التعلّم على طلبك المحدّد.
لماذا يهمّك
ضمن موضوع كيف يعمل الذكاء الاصطناعي فعلًا → الـ inference هو ما تدفع مقابله في كلّ مرّة تستخدم فيها الذكاء الاصطناعي، وما يستهلك الـ tokens — فهو التكلفة التي تتوسّع بقدر استخدامك، لا فاتورة الـ training التي تُدفع مرّة واحدة.
انظر أيضًا