Ollama دیگر فقط هوش مصنوعی محلی نیست: قیمت‌گذاری ابری، حریم خصوصی و کسب‌وکار مدل باز

Victor Ramirez – Tapbit Learn Technical AnalystVictor Ramirez|1 دقیقه زمان مطالعه

نکات کلیدی

- Ollama در تاریخ ۳۱ اوت ۲۰۲۶ طرح‌های ابری با قیمت‌گذاری توکن به توکن را راه‌اندازی کرد، در حالی که نرم‌افزار اصلی محلی خود را تحت مجوز MIT رایگان نگه داشت.

- Ollama Cloud جدید، استنتاج با حفظ صفر داده را برای مدل‌هایی که برای اجرا راحت روی رایانه‌های شخصی بسیار بزرگ هستند، ارائه می‌دهد.

- Claude Desktop و عوامل کدنویسی مختلف اکنون از ادغام با Ollama برای مدل‌های باز محلی و ابری پشتیبانی می‌کنند.

- Ollama Pro با قیمت ۲۰ دلار در ماه یا ۲۰۰ دلار در سال قیمت‌گذاری شده است و ۶۰ دلار اعتبار استفاده ابری ماهانه را ارائه می‌دهد.

پلتفرم ابری Ollama

Ollama شهرت خود را بر اساس یک گزاره ارزش ساده بنا نهاد: یک مدل باز را دانلود کنید، آن را به صورت محلی اجرا کنید و داده‌های خود را دور از ابر نگه دارید.

این توضیحات همچنان پابرجاست، اما دیگر تصویر کاملی را ارائه نمی‌دهد.

در تاریخ ۳۱ اوت ۲۰۲۶، Ollama طرح‌های ابری مبتنی بر قیمت‌گذاری توکن به توکن را معرفی کرد. چند روز قبل، پشتیبانی از اجرای مدل‌های Ollama از طریق Claude Desktop را اضافه کرد. این پلتفرم اکنون استنتاج ابری، جستجوی وب، ادغام عوامل کدنویسی و حساب‌های تیمی پولی را در کنار نرم‌افزار محلی اصلی ارائه می‌دهد.

Ollama از هوش مصنوعی محلی دست نکشیده است - بلکه در حال ایجاد کسب‌وکاری در نقطه‌ای است که سخت‌افزار محلی دیگر تمام نیازهای کاربر را برآورده نمی‌کند.

Ollama محلی همچنان رایگان است

 

نرم‌افزار اصلی Ollama تحت مجوز MIT در دسترس است. کاربران می‌توانند مدل‌ها را دانلود کرده و بدون پرداخت هزینه به Ollama برای هر درخواست، آن‌ها را روی سخت‌افزار خود اجرا کنند.

این برنامه دانلود مدل، ذخیره‌سازی و تشخیص سخت‌افزار را مدیریت می‌کند. همچنین یک API محلی را در دسترس قرار می‌دهد، بنابراین برنامه‌های دیگر می‌توانند از مدل نصب شده استفاده کنند.

این رویکرد برای تجزیه و تحلیل اسناد خصوصی، دستیارهای آفلاین، توسعه نرم‌افزار و آزمایش‌هایی که از طریق یک API اندازه‌گیری شده گران می‌شوند، به خوبی کار می‌کند. اجرای یک مدل به صورت محلی همچنین به کاربران کنترل بیشتری بر انتخاب مدل، درخواست‌های سیستمی و ذخیره‌سازی می‌دهد.

هنوز هزینه‌ای وجود دارد، فقط نه یک صورتحساب استفاده از Ollama. مدل‌های بزرگتر به حافظه، ذخیره‌سازی و برق بیشتری نیاز دارند. یک مدل کوچک ممکن است روی یک لپ‌تاپ معمولی اجرا شود، در حالی که یک مدل استدلال یا چندوجهی بزرگ می‌تواند به یک GPU یا ایستگاه کاری گران قیمت نیاز داشته باشد.

هوش مصنوعی محلی هزینه را از توکن‌های ابری به سخت‌افزار منتقل می‌کند.

Ollama Cloud محاسبه را تغییر می‌دهد

Ollama Cloud برای مدل‌هایی ایجاد شده است که به راحتی روی رایانه‌های شخصی قرار نمی‌گیرند. این به کاربران امکان می‌دهد تا از همان ابزارهای خط فرمان و APIها استفاده کنند و در عین حال استنتاج را به سخت‌افزار مرکز داده منتقل کنند.

این راحتی دو بخش مهم از گزاره اصلی را تغییر می‌دهد: قیمت و مکان داده.

استفاده از ابر بر اساس توکن اندازه‌گیری می‌شود. پس از اتمام سهمیه شامل شده، کاربران می‌توانند با نرخ منتشر شده برای هر مدل، استفاده بیشتری خریداری کنند. اعتبارات ماهانه استفاده نشده منتقل نمی‌شوند.

Ollama می‌گوید این تغییر، صورتحساب زمان GPU کمتر قابل پیش‌بینی را جایگزین می‌کند و محدودیت‌های قبلی پنج ساعته و هفتگی را حذف می‌کند. اجرای مدل‌ها روی سخت‌افزار شخصی نامحدود باقی می‌ماند.

نتیجه یک محصول ترکیبی است. Ollama بسته به نحوه استفاده، می‌تواند نرم‌افزار محلی رایگان، یک API پرداخت به ازای استفاده یا اشتراک ابری ماهانه باشد.

آیا Ollama داده‌ها را محلی نگه می‌دارد؟

فقط مدل‌های محلی کل فرآیند استنتاج را روی دستگاه کاربر نگه می‌دارند. هنگامی که نام مدل دارای پسوند ابری است، درخواست توسط زیرساخت Ollama پردازش می‌شود. این شرکت می‌گوید درخواست‌ها و پاسخ‌های ابری ثبت، نگهداری یا برای آموزش استفاده نمی‌شوند. مستندات منتشر شده آن بیان می‌کند که محاسبات عمدتاً در ایالات متحده و اروپا میزبانی می‌شود و سنگاپور برای گروه محدودی از مدل‌های Qwen استفاده می‌شود.

این یک سیاست حفظ صفر داده است، نه پردازش محلی.

این تمایز برای مشاغلی که با کد منبع، مواد قانونی، سوابق مشتری یا تحقیقات داخلی کار می‌کنند، اهمیت دارد. یک درخواست می‌تواند توسط خط مشی رازداری ارائه‌دهنده محافظت شود و همچنان از مرز شبکه شرکت عبور کند.

Ollama به کاربران اجازه می‌دهد تا عملکردهای ابری خود را از طریق تنظیمات پیکربندی غیرفعال کنند. انجام این کار همچنین دسترسی به مدل‌های ابری و سرویس جستجوی وب Ollama را حذف می‌کند. تیم‌هایی که به یک محیط فقط محلی نیاز دارند باید این تنظیم را تأیید کنند تا فرض نکنند که هر درخواست روی دستگاه می‌ماند.

Claude Desktop اکنون می‌تواند مدل‌های Ollama را اجرا کند

Ollama پشتیبانی Claude Desktop را در ۲۵ اوت اضافه کرد. کاربران می‌توانند Ollama را به عنوان یک دروازه شخص ثالث پیکربندی کنند و یا یک مدل محلی یا مدلی را که روی Ollama Cloud میزبانی می‌شود، انتخاب کنند.

این ترتیب می‌تواند سوء تفاهم شود.

مدلی که در رابط Claude Desktop اجرا می‌شود لزوماً یک مدل Claude نیست. Anthropic رابط برنامه را ارائه می‌دهد، در حالی که Ollama مدل انتخاب شده و مسیر استنتاج را تأمین می‌کند. بنابراین، کیفیت خروجی، مدیریت زمینه و پشتیبانی ابزار به مدل Ollama مورد استفاده بستگی دارد.

این به‌روزرسانی مهم است زیرا رابط هوش مصنوعی را از ارائه‌دهنده هوش مصنوعی جدا می‌کند. کاربران می‌توانند در حالی که مدل زیرین را تغییر می‌دهند، یک فضای کاری آشنا را حفظ کنند.

الگوی مشابهی در بازار توسعه‌دهندگان در حال ظهور است. Ollama اکنون با Codex، Claude Code، OpenCode و سایر عوامل کدنویسی کار می‌کند. دستور راه‌اندازی ollama آن به پیکربندی این ابزارها بدون نیاز به بازسازی گردش کار توسط توسعه‌دهندگان در اطراف هر ارائه‌دهنده مدل کمک می‌کند.

سازگاری OpenAI سوئیچ را آسان‌تر می‌کند، نه کامل

Ollama از بخش‌هایی از فرمت API OpenAI پشتیبانی می‌کند. برنامه‌های موجود می‌توانند درخواست‌های پشتیبانی شده را به یک نقطه پایانی Ollama هدایت کرده و از مدل‌های باز محلی یا ابری استفاده کنند.

لایه سازگاری شامل تکمیل چت، جریان، جاسازی‌ها، ورودی بصری، فراخوانی ابزار و بخش‌هایی از API پاسخ‌ها است. Ollama همچنین یک نقطه پایانی تولید تصویر آزمایشی معرفی کرده است.

"سازگار" به معنای یکسان نیست. برخی از فیلدها و توابع حالت‌دار OpenAI به طور کامل پشتیبانی نمی‌شوند و رفتار مدل می‌تواند به طور قابل توجهی متفاوت باشد. توسعه‌دهندگان همچنان باید قبل از جایگزینی یک نقطه پایانی تولیدی، فراخوانی ابزار، خروجی ساختاریافته، طول زمینه و مدیریت خطا را آزمایش کنند.

مزیت عملی، اصطکاک کمتر مهاجرت است. یک شرکت می‌تواند یک مدل باز را بدون بازنویسی کل برنامه خود آزمایش کند.

کتابخانه مدل فراتر از Llama 3 رفته است

 

توضیحات قدیمی‌تر Ollama اغلب بر Llama 3، Gemma 2، Phi-3 و Qwen 2.5 تمرکز دارند. این مدل‌ها همچنان در دسترس هستند، اما کتابخانه گسترش یافته است.

افزوده‌های اخیر شامل Gemma 4، Qwen 3.8، GLM 5.3، NVIDIA Nemotron 3.5 Lightning، Muse Glimmer و مدل‌های جدیدتر DeepSeek و Kimi است. برخی از آن‌ها برای عوامل کدنویسی، ورودی چندوجهی یا استفاده طولانی مدت از ابزار به جای چت ساده طراحی شده‌اند.

همه مدل‌ها را نمی‌توان به صورت محلی دانلود و اجرا کرد. برخی از بزرگترین نسخه‌ها فقط از طریق Ollama Cloud در دسترس هستند. کاربران باید برچسب مدل، اندازه دانلود و مجوز را بررسی کنند، نه اینکه فرض کنند همه چیز در کتابخانه محلی و بدون محدودیت است.

نرم‌افزار خود Ollama از مجوز MIT استفاده می‌کند، اما مدل‌های فردی مجوزهای انتخاب شده توسط سازندگان خود را حفظ می‌کنند. وزن‌های باز به طور خودکار استفاده تجاری نامحدود را اعطا نمی‌کنند.

مدل کسب‌وکار Ollama در حال روشن‌تر شدن است

Ollama در ژوئیه ۲۰۲۶ دور تأمین مالی ۸۸ میلیون دلاری را اعلام کرد. این شرکت می‌گوید اکنون به ۸.۹ میلیون توسعه‌دهنده خدمات می‌دهد و در ۸۵٪ از شرکت‌های Fortune 500 استفاده می‌شود. این ارقام پذیرش از Ollama آمده‌اند و به طور مستقل حسابرسی نشده‌اند، اما مقیاس جاه‌طلبی‌های تجاری آن را نشان می‌دهند.

این استراتژی چندین بخش دارد: نرم‌افزار محلی توسعه‌دهندگان را وارد اکوسیستم می‌کند. سازگاری API پذیرش Ollama را آسان می‌کند. ادغام‌ها آن را به ابزارهای کدنویسی تثبیت شده متصل می‌کنند. استنتاج ابری کاربرانی را که به محاسبات بیشتری نسبت به سخت‌افزار خود نیاز دارند، پولی می‌کند.

این غیرمعمول نیست. شرکت‌های زیرساخت منبع باز اغلب نرم‌افزار اصلی را در دسترس نگه می‌دارند و در عین حال برای میزبانی، مقیاس و ویژگی‌های مدیریتی هزینه دریافت می‌کنند.

تنش در موقعیت‌یابی نهفته است. Ollama به عنوان جایگزینی برای هوش مصنوعی ابری اندازه‌گیری شده محبوب شد. اکنون باید کاربران را متقاعد کند که ابر خودش عملکرد، حریم خصوصی و انتخاب مدل کافی را برای توجیه صورتحساب توکن دیگر ارائه می‌دهد.

Ollama به چه چیزی تبدیل شده است

Ollama همچنان هوش مصنوعی محلی را آسان‌تر می‌کند. این همچنان قوی‌ترین مزیت محصول آن است.

آنچه تغییر کرده است، مسیری است که پس از اتمام فضای سخت‌افزار محلی در دسترس است. کاربران دیگر مجبور نیستند برای دسترسی به مدل‌های بزرگتر، جستجوی وب یا محاسبات ابری، محیط Ollama را ترک کنند. آن‌ها می‌توانند در حالی که بسیاری از ابزارهای یکسان را حفظ می‌کنند، بین استنتاج محلی و میزبانی شده جابجا شوند.

این راحتی با انتخاب‌هایی همراه است که داستان اصلی فقط محلی نیازی به آن‌ها نداشت. کاربران اکنون باید بدانند هر مدل در کجا اجرا می‌شود، توکن‌های ابری چگونه صورتحساب می‌شوند و کدام خط مشی رازداری برای هر درخواست اعمال می‌شود.

Ollama دیگر صرفاً راهی برای اجتناب از ابر هوش مصنوعی نیست. این تلاش می‌کند تا لایه‌ای شود که تصمیم می‌گیرد چه زمانی ابر ضروری است.

خوانندگانی که همپوشانی بین زیرساخت هوش مصنوعی، محاسبات ابری و بازارهای دیجیتال را دنبال می‌کنند، می‌توانند تحقیقات بیشتری را در Tapbit بیابند. کاربران Tapbit می‌توانند وارد شوند، در حالی که کسانی که پلتفرم را کاوش می‌کنند می‌توانند حساب کاربری ایجاد کنند.

سوالات متداول

آیا Ollama رایگان است؟

Ollama زمانی رایگان است که مدل‌ها روی سخت‌افزار کاربر اجرا شوند. Ollama Cloud دارای استفاده اولیه رایگان است اما برای استنتاج ابری اضافی هزینه دریافت می‌کند.

آیا Ollama به ازای هر توکن هزینه دریافت می‌کند؟

استنتاج محلی هزینه توکن به توکن Ollama ندارد. مدل‌های ابری از قیمت‌های منتشر شده توکن به توکن استفاده می‌کنند، با اعتبارات استفاده ماهانه که در طرح‌های پولی گنجانده شده است.

هزینه Ollama Pro چقدر است؟

Ollama Pro طبق قیمت‌گذاری منتشر شده در ۳۱ اوت ۲۰۲۶، ۲۰ دلار در ماه یا ۲۰۰ دلار در سال هزینه دارد. این شامل ۶۰ دلار اعتبار استفاده ابری ماهانه است.

سلب مسئولیت

معامله‌گری ارزهای دیجیتال با ریسک قابل توجهی از زیان همراه است. قیمت‌ها بسیار نوسانی بوده و می‌توانند به سرعت تغییر کنند. یکپارچه‌سازی‌های پروتکل، کاربردهای توکن و جدول زمانی نقشه راه ممکن است تغییر کنند. این مقاله صرفاً برای اهداف اطلاعاتی است و توصیه سرمایه‌گذاری محسوب نمی‌شود. همیشه تحقیقات خود را انجام دهید (DYOR) و هرگز بیش از آنچه می‌توانید به طور کامل از دست بدهید، سرمایه‌گذاری نکنید.

تسلط بر بازار کریپتو

منابع تخصصی، آموزش‌ها و جدیدترین روندهای رمزارز را دریافت کنید. برای شروع معاملات خود ثبت‌نام کنید.