Ollama نسخه 0.32.6 - یادداشت های انتشار
چه چیزی تغییر کرده است
- Qwen3.5 در پردازندههای گرافیکی اپل سریعتر است: موتور MLX اکنون از هد MTP مدل برای رمزگشایی حدسی خودکار استفاده میکند جریان
/v1/chat/completionsاکنون با فرمت سیم OpenAI مطابقت دارد:roleفقط در قسمت اول،finish_reasonدر قسمت خود،
و در یک بخش جداگانه باstream_options.include_usageاستفاده کنید.- پاسخ های کوتاه شده OpenAI اکنون
finish_reason: "length"را به جای"tool_calls"گزارش می دهند. ollama run kimi-k3اکنونkimi-k3:cloudرا برای مدلهای فقط ابری ارائه میکند که به جای شکست، برچسب پیشفرض منتشر نمیکنند.- اصلاحات TUI: نثر جدا شده با لوله دیگر به صورت جدول ارائه نمی شود، Enter تکمیل فایل
@برجسته شده را می پذیرد و/prompt
پیمایش دیگر تاخیر ندارد. - تولید تصویر آزمایشی به طور موقت حذف شده است. به استفاده از 0.32.5 برای پشتیبانی از تولید تصویر ادامه دهید
- موتورهای MLX و llama.cpp را به روز کرد.
تغییر کامل: v0.32.5...v0.32.6-rc0