Ollama شهرت خود را بر اساس یک گزاره ارزش ساده بنا نهاد: یک مدل باز را دانلود کنید، آن را به صورت محلی اجرا کنید و دادههای خود را دور از ابر نگه دارید.
این توضیحات همچنان پابرجاست، اما دیگر تصویر کاملی را ارائه نمیدهد.
در تاریخ ۳۱ اوت ۲۰۲۶، Ollama طرحهای ابری مبتنی بر قیمتگذاری توکن به توکن را معرفی کرد. چند روز قبل، پشتیبانی از اجرای مدلهای Ollama از طریق Claude Desktop را اضافه کرد. این پلتفرم اکنون استنتاج ابری، جستجوی وب، ادغام عوامل کدنویسی و حسابهای تیمی پولی را در کنار نرمافزار محلی اصلی ارائه میدهد.
Ollama از هوش مصنوعی محلی دست نکشیده است - بلکه در حال ایجاد کسبوکاری در نقطهای است که سختافزار محلی دیگر تمام نیازهای کاربر را برآورده نمیکند.
Ollama محلی همچنان رایگان است

نرمافزار اصلی Ollama تحت مجوز MIT در دسترس است. کاربران میتوانند مدلها را دانلود کرده و بدون پرداخت هزینه به Ollama برای هر درخواست، آنها را روی سختافزار خود اجرا کنند.
این برنامه دانلود مدل، ذخیرهسازی و تشخیص سختافزار را مدیریت میکند. همچنین یک API محلی را در دسترس قرار میدهد، بنابراین برنامههای دیگر میتوانند از مدل نصب شده استفاده کنند.
این رویکرد برای تجزیه و تحلیل اسناد خصوصی، دستیارهای آفلاین، توسعه نرمافزار و آزمایشهایی که از طریق یک API اندازهگیری شده گران میشوند، به خوبی کار میکند. اجرای یک مدل به صورت محلی همچنین به کاربران کنترل بیشتری بر انتخاب مدل، درخواستهای سیستمی و ذخیرهسازی میدهد.
هنوز هزینهای وجود دارد، فقط نه یک صورتحساب استفاده از Ollama. مدلهای بزرگتر به حافظه، ذخیرهسازی و برق بیشتری نیاز دارند. یک مدل کوچک ممکن است روی یک لپتاپ معمولی اجرا شود، در حالی که یک مدل استدلال یا چندوجهی بزرگ میتواند به یک GPU یا ایستگاه کاری گران قیمت نیاز داشته باشد.
هوش مصنوعی محلی هزینه را از توکنهای ابری به سختافزار منتقل میکند.
Ollama Cloud محاسبه را تغییر میدهد
Ollama Cloud برای مدلهایی ایجاد شده است که به راحتی روی رایانههای شخصی قرار نمیگیرند. این به کاربران امکان میدهد تا از همان ابزارهای خط فرمان و APIها استفاده کنند و در عین حال استنتاج را به سختافزار مرکز داده منتقل کنند.
این راحتی دو بخش مهم از گزاره اصلی را تغییر میدهد: قیمت و مکان داده.
استفاده از ابر بر اساس توکن اندازهگیری میشود. پس از اتمام سهمیه شامل شده، کاربران میتوانند با نرخ منتشر شده برای هر مدل، استفاده بیشتری خریداری کنند. اعتبارات ماهانه استفاده نشده منتقل نمیشوند.
Ollama میگوید این تغییر، صورتحساب زمان GPU کمتر قابل پیشبینی را جایگزین میکند و محدودیتهای قبلی پنج ساعته و هفتگی را حذف میکند. اجرای مدلها روی سختافزار شخصی نامحدود باقی میماند.
نتیجه یک محصول ترکیبی است. Ollama بسته به نحوه استفاده، میتواند نرمافزار محلی رایگان، یک API پرداخت به ازای استفاده یا اشتراک ابری ماهانه باشد.
آیا Ollama دادهها را محلی نگه میدارد؟
فقط مدلهای محلی کل فرآیند استنتاج را روی دستگاه کاربر نگه میدارند. هنگامی که نام مدل دارای پسوند ابری است، درخواست توسط زیرساخت Ollama پردازش میشود. این شرکت میگوید درخواستها و پاسخهای ابری ثبت، نگهداری یا برای آموزش استفاده نمیشوند. مستندات منتشر شده آن بیان میکند که محاسبات عمدتاً در ایالات متحده و اروپا میزبانی میشود و سنگاپور برای گروه محدودی از مدلهای Qwen استفاده میشود.
این یک سیاست حفظ صفر داده است، نه پردازش محلی.
این تمایز برای مشاغلی که با کد منبع، مواد قانونی، سوابق مشتری یا تحقیقات داخلی کار میکنند، اهمیت دارد. یک درخواست میتواند توسط خط مشی رازداری ارائهدهنده محافظت شود و همچنان از مرز شبکه شرکت عبور کند.
Ollama به کاربران اجازه میدهد تا عملکردهای ابری خود را از طریق تنظیمات پیکربندی غیرفعال کنند. انجام این کار همچنین دسترسی به مدلهای ابری و سرویس جستجوی وب Ollama را حذف میکند. تیمهایی که به یک محیط فقط محلی نیاز دارند باید این تنظیم را تأیید کنند تا فرض نکنند که هر درخواست روی دستگاه میماند.
Claude Desktop اکنون میتواند مدلهای Ollama را اجرا کند
Ollama پشتیبانی Claude Desktop را در ۲۵ اوت اضافه کرد. کاربران میتوانند Ollama را به عنوان یک دروازه شخص ثالث پیکربندی کنند و یا یک مدل محلی یا مدلی را که روی Ollama Cloud میزبانی میشود، انتخاب کنند.
این ترتیب میتواند سوء تفاهم شود.
مدلی که در رابط Claude Desktop اجرا میشود لزوماً یک مدل Claude نیست. Anthropic رابط برنامه را ارائه میدهد، در حالی که Ollama مدل انتخاب شده و مسیر استنتاج را تأمین میکند. بنابراین، کیفیت خروجی، مدیریت زمینه و پشتیبانی ابزار به مدل Ollama مورد استفاده بستگی دارد.
این بهروزرسانی مهم است زیرا رابط هوش مصنوعی را از ارائهدهنده هوش مصنوعی جدا میکند. کاربران میتوانند در حالی که مدل زیرین را تغییر میدهند، یک فضای کاری آشنا را حفظ کنند.
الگوی مشابهی در بازار توسعهدهندگان در حال ظهور است. Ollama اکنون با Codex، Claude Code، OpenCode و سایر عوامل کدنویسی کار میکند. دستور راهاندازی ollama آن به پیکربندی این ابزارها بدون نیاز به بازسازی گردش کار توسط توسعهدهندگان در اطراف هر ارائهدهنده مدل کمک میکند.
سازگاری OpenAI سوئیچ را آسانتر میکند، نه کامل
Ollama از بخشهایی از فرمت API OpenAI پشتیبانی میکند. برنامههای موجود میتوانند درخواستهای پشتیبانی شده را به یک نقطه پایانی Ollama هدایت کرده و از مدلهای باز محلی یا ابری استفاده کنند.
لایه سازگاری شامل تکمیل چت، جریان، جاسازیها، ورودی بصری، فراخوانی ابزار و بخشهایی از API پاسخها است. Ollama همچنین یک نقطه پایانی تولید تصویر آزمایشی معرفی کرده است.
"سازگار" به معنای یکسان نیست. برخی از فیلدها و توابع حالتدار OpenAI به طور کامل پشتیبانی نمیشوند و رفتار مدل میتواند به طور قابل توجهی متفاوت باشد. توسعهدهندگان همچنان باید قبل از جایگزینی یک نقطه پایانی تولیدی، فراخوانی ابزار، خروجی ساختاریافته، طول زمینه و مدیریت خطا را آزمایش کنند.
مزیت عملی، اصطکاک کمتر مهاجرت است. یک شرکت میتواند یک مدل باز را بدون بازنویسی کل برنامه خود آزمایش کند.
کتابخانه مدل فراتر از Llama 3 رفته است
توضیحات قدیمیتر Ollama اغلب بر Llama 3، Gemma 2، Phi-3 و Qwen 2.5 تمرکز دارند. این مدلها همچنان در دسترس هستند، اما کتابخانه گسترش یافته است.
افزودههای اخیر شامل Gemma 4، Qwen 3.8، GLM 5.3، NVIDIA Nemotron 3.5 Lightning، Muse Glimmer و مدلهای جدیدتر DeepSeek و Kimi است. برخی از آنها برای عوامل کدنویسی، ورودی چندوجهی یا استفاده طولانی مدت از ابزار به جای چت ساده طراحی شدهاند.
همه مدلها را نمیتوان به صورت محلی دانلود و اجرا کرد. برخی از بزرگترین نسخهها فقط از طریق Ollama Cloud در دسترس هستند. کاربران باید برچسب مدل، اندازه دانلود و مجوز را بررسی کنند، نه اینکه فرض کنند همه چیز در کتابخانه محلی و بدون محدودیت است.
نرمافزار خود Ollama از مجوز MIT استفاده میکند، اما مدلهای فردی مجوزهای انتخاب شده توسط سازندگان خود را حفظ میکنند. وزنهای باز به طور خودکار استفاده تجاری نامحدود را اعطا نمیکنند.
مدل کسبوکار Ollama در حال روشنتر شدن است
Ollama در ژوئیه ۲۰۲۶ دور تأمین مالی ۸۸ میلیون دلاری را اعلام کرد. این شرکت میگوید اکنون به ۸.۹ میلیون توسعهدهنده خدمات میدهد و در ۸۵٪ از شرکتهای Fortune 500 استفاده میشود. این ارقام پذیرش از Ollama آمدهاند و به طور مستقل حسابرسی نشدهاند، اما مقیاس جاهطلبیهای تجاری آن را نشان میدهند.
این استراتژی چندین بخش دارد: نرمافزار محلی توسعهدهندگان را وارد اکوسیستم میکند. سازگاری API پذیرش Ollama را آسان میکند. ادغامها آن را به ابزارهای کدنویسی تثبیت شده متصل میکنند. استنتاج ابری کاربرانی را که به محاسبات بیشتری نسبت به سختافزار خود نیاز دارند، پولی میکند.
این غیرمعمول نیست. شرکتهای زیرساخت منبع باز اغلب نرمافزار اصلی را در دسترس نگه میدارند و در عین حال برای میزبانی، مقیاس و ویژگیهای مدیریتی هزینه دریافت میکنند.
تنش در موقعیتیابی نهفته است. Ollama به عنوان جایگزینی برای هوش مصنوعی ابری اندازهگیری شده محبوب شد. اکنون باید کاربران را متقاعد کند که ابر خودش عملکرد، حریم خصوصی و انتخاب مدل کافی را برای توجیه صورتحساب توکن دیگر ارائه میدهد.
Ollama به چه چیزی تبدیل شده است
Ollama همچنان هوش مصنوعی محلی را آسانتر میکند. این همچنان قویترین مزیت محصول آن است.
آنچه تغییر کرده است، مسیری است که پس از اتمام فضای سختافزار محلی در دسترس است. کاربران دیگر مجبور نیستند برای دسترسی به مدلهای بزرگتر، جستجوی وب یا محاسبات ابری، محیط Ollama را ترک کنند. آنها میتوانند در حالی که بسیاری از ابزارهای یکسان را حفظ میکنند، بین استنتاج محلی و میزبانی شده جابجا شوند.
این راحتی با انتخابهایی همراه است که داستان اصلی فقط محلی نیازی به آنها نداشت. کاربران اکنون باید بدانند هر مدل در کجا اجرا میشود، توکنهای ابری چگونه صورتحساب میشوند و کدام خط مشی رازداری برای هر درخواست اعمال میشود.
Ollama دیگر صرفاً راهی برای اجتناب از ابر هوش مصنوعی نیست. این تلاش میکند تا لایهای شود که تصمیم میگیرد چه زمانی ابر ضروری است.
خوانندگانی که همپوشانی بین زیرساخت هوش مصنوعی، محاسبات ابری و بازارهای دیجیتال را دنبال میکنند، میتوانند تحقیقات بیشتری را در Tapbit بیابند. کاربران Tapbit میتوانند وارد شوند، در حالی که کسانی که پلتفرم را کاوش میکنند میتوانند حساب کاربری ایجاد کنند.
سوالات متداول
آیا Ollama رایگان است؟
Ollama زمانی رایگان است که مدلها روی سختافزار کاربر اجرا شوند. Ollama Cloud دارای استفاده اولیه رایگان است اما برای استنتاج ابری اضافی هزینه دریافت میکند.
آیا Ollama به ازای هر توکن هزینه دریافت میکند؟
استنتاج محلی هزینه توکن به توکن Ollama ندارد. مدلهای ابری از قیمتهای منتشر شده توکن به توکن استفاده میکنند، با اعتبارات استفاده ماهانه که در طرحهای پولی گنجانده شده است.
هزینه Ollama Pro چقدر است؟
Ollama Pro طبق قیمتگذاری منتشر شده در ۳۱ اوت ۲۰۲۶، ۲۰ دلار در ماه یا ۲۰۰ دلار در سال هزینه دارد. این شامل ۶۰ دلار اعتبار استفاده ابری ماهانه است.

