Ollama نسخه 0.32.6 - یادداشت های انتشار

منبع / نسخه بالادست

چه چیزی تغییر کرده است

  • Qwen3.5 در پردازنده‌های گرافیکی اپل سریع‌تر است: موتور MLX اکنون از هد MTP مدل برای رمزگشایی حدسی خودکار استفاده می‌کند
  • جریان
  • /v1/chat/completions اکنون با فرمت سیم OpenAI مطابقت دارد: role فقط در قسمت اول، finish_reason در قسمت خود،
    و در یک بخش جداگانه با stream_options.include_usage استفاده کنید.
  • پاسخ های کوتاه شده OpenAI اکنون finish_reason: "length" را به جای "tool_calls" گزارش می دهند.
  • ollama run kimi-k3 اکنون kimi-k3:cloud را برای مدل‌های فقط ابری ارائه می‌کند که به جای شکست، برچسب پیش‌فرض منتشر نمی‌کنند.
  • اصلاحات TUI: نثر جدا شده با لوله دیگر به صورت جدول ارائه نمی شود، Enter تکمیل فایل @ برجسته شده را می پذیرد و /prompt
    پیمایش دیگر تاخیر ندارد.
  • تولید تصویر آزمایشی به طور موقت حذف شده است. به استفاده از 0.32.5 برای پشتیبانی از تولید تصویر ادامه دهید
  • موتورهای MLX و llama.cpp را به روز کرد.

تغییر کامل: v0.32.5...v0.32.6-rc0

بازگشت به لیست اخبار دانشنامه
enamad