إزاي DeepSeek V4 Flash وفّرلي تقريبًا 500 دولار كل شهر؟
أنا تقريبًا عديت بكل مراحل صرف الفلوس على الـ AI، وعشان كده بكتب التجربة دي لأي Vibe Coder لسه في البداية قبل ما يدخل نفس الدايرة ويصرف فلوس كتير من غير ما يكون محتاج يعمل كده.
في الأول بدأت باشتراك Claude بـ100 دولار، وبعدها رقيته لـ200 دولار. ولما GPT-5.5 أثبت بالنسبة لي إنه قوي فعلًا، اشتركت كمان في ChatGPT بـ100 دولار.
بعدها، مع ظهور GPT-5.6 Sol وTerra، حسيت إن الاشتراك بقى يستاهل أكتر. وبالمناسبة، Luna من الموديلات المفضلة عندي، لكن هشرح السبب في بوست منفصل.
بعد كده جرّبت Kimi K2.7 وGLM 5.2، والاتنين أثبتوا قيمة كبيرة بالنسبة لي مقابل حوالي 10 دولارات بس، فدخلتهم ضمن الـ stack بتاعتي.
رغم كل ده، كنت أخلص معظم الـ limits في 3 أيام، وبعدها أفضل مستني الـ reset كأني مستني المرتب آخر الشهر.
في اللحظة دي بدأت أسأل نفسي: إزاي ناس كتير شغالة في AI Engineering طول اليوم، ومش بتدفع كل الأرقام دي، ولسه عندها limits متاحة؟
هل فعلًا كل Task محتاجة أقوى وأغلى model موجود؟
الإجابة اللي وصلت لها من التجربة: لأ.
أنا كنت بستخدم المدير عشان يعمل شغل العامل.
وهنا بدأت أفهم أهمية OpenRouter وOpenCode.
أنا مكنتش عايز أغيّر البيئة اللي متعود عليها. كنت عايز أفضل شغال من داخل VS Code، وأكمل استخدام Claude وChatGPT وCodex، لكن في نفس الوقت أحتاج موديلات تشتغل معايا طول اليوم من غير ما تحرق الباقات المدفوعة.
من داخل OpenCode بدأت أجرّب موديلات مجانية زي DeepSeek V4 Flash وLaguna 2.1 وHY3 وNemotron 3 Ultra.
أنا جرّبتهم في شغل حقيقي، مش Benchmark، ومش فيديو مدته 30 ثانية معمول عشان يقولك إن الموديل هيبني لك شركة قبل ما القهوة تبرد.
من تجربتي الشخصية، Nemotron 3 Ultra هو أفضل موديل مجاني جرّبته في الـ reasoning. بيفكر بشكل منظم، وبيتعامل مع المهام المعقدة أحسن من معظم الاختيارات المجانية اللي جربتها.
أما Laguna 2.1، فهو من أقوى الاختيارات اللي جربتها في agentic coding execution. لما يشتغل كويس، تنفيذه قوي جدًا، لكن الـ streaming المجاني ساعات بيعلق، وده بيخليه مش ثابت كفاية بالنسبة لي كـ daily worker.
أما DeepSeek V4 Flash، فهو أفضل worker model مجاني بالنسبة لي حاليًا.
سريع بشكل مبالغ فيه، والـ limits بتاعته سخية جدًا، ولحد دلوقتي أنا شخصيًا محصلش معايا إني خلصت الـ limit بتاعته.
هل هو أقوى من Claude أو GPT-5.6؟ طبعًا لأ. الفرق في الجودة موجود وواضح.
لكن ده مش السؤال الصح.
السؤال الصح هو: مين أنسب موديل للمهمة دي؟
إنت مش محتاج أقوى عقل في العالم عشان يشغل test suite، أو يصلح encoding issue، أو يعدل ملف واضح، أو ينفذ Task مكتوبة بالتفصيل.
إنت محتاج worker سريع، متوفر، وينفذ التعليمات تحت مراجعة موديل أقوى.
وده خلاني أبني الـ stack بالشكل ده: Claude وChatGPT هما الـ managers، وDeepSeek V4 Flash وNemotron 3 Ultra هما الـ free workers.
في التخطيط، بستخدم Fable 5 عشان يعمل الـ master plan باستخدام spec-kit، وبعدها GPT-5.6 Sol يراجع الخطة على x-high reasoning.
المرحلة دي غالبًا بتستهلك حوالي 3% إلى 5% بس من الـ plan limits.
بعدها GPT-5.6 Terra بيبقى الـ reviewer لكل Task على high reasoning. هو اللي يحدد المطلوب، ويكتب تعليمات واضحة للـ worker، ويراجع النتيجة، ويكتشف النواقص، ويطلب التعديلات قبل ما نقفل كل milestone.
أما التنفيذ الثقيل والمتكرر، فبيروح إلى DeepSeek V4 Flash.
وكمان ركبت OpenCode Delegate عشان توزيع المهام بين الموديلات يبقى أسهل.
الصورة المرفقة مش مجرد setup شكله حلو. ده بقى جزء من طريقة شغلي اليومية.
لحد دلوقتي، استخدمت أكتر من 290 مليون token على DeepSeek V4 Flash مجانًا.
أنا مش قادر أتخيل الرقم ده كان هيكلفني كام لو كل التنفيذ راح على الـ premium models.
وده اللي وفّرلي تقريبًا 500 دولار شهريًا، وخلاني أفكر بجد أقلل جزء كبير من الاشتراكات الأساسية اللي بدفعها.
بس خد بالك من نقطة مهمة: قبل ما تستخدم أي موديل مجاني مع client code أو secrets أو production credentials أو بيانات خاصة، راجع سياسة البيانات الخاصة بالخدمة.
متبعتش بيانات حساسة بشكل عشوائي لمجرد إن الـ endpoint مكتوب عليه Free.
الخلاصة من تجربتي: مش لازم تدفع لأغلى موديل عشان ينفذ كل سطر في مشروعك.
ادفع للذكاء في المكان اللي محتاج قرار قوي، واستخدم worker أرخص أو مجاني في التنفيذ المتكرر.
لأن لو إنت بتبيع software، وتكلفتك الداخلية هي 500 دولار موديلات، بالإضافة لمجهودك والسيرفرات والـ tools وباقي الفواتير، فممكن تكتشف إنك مش بتعمل profit حقيقي.
إنت بس بتحوّل الفلوس من العميل لشركات الـ AI.
أنا مش بقول إن المجاني أحسن من Claude أو ChatGPT.
أنا بقول إن الـ proper stack أقوى من الاعتماد على موديل واحد غالي يعمل كل حاجة.
الفرق الحقيقي مش إنك تمتلك أقوى موديل.
الفرق إنك تعرف مين يخطط، ومين يراجع، ومين ينفذ.
البوست الجاي هيكون عن OpenCode، وبالتحديد عن الـ delegation skills اللي خلتني أوزع الشغل بين الموديلات بالطريقة دي.
لو عندك سؤال عن الـ setup، اكتبه في التعليقات وهرد عليه من تجربتي.
التعليقات (0)
0مفيش تعليقات لحد دلوقتي. كن أول واحد يشارك.