Back to Freedom.Tech Back
All llama.cpp releasesAll versions
Release Fri, Aug 14, 2026 1 min read

llama.cpp b10434

Original release notes

chat : pass reasoning_effort to template

  • chat: add reasoning_effort to common_chat_templates_inputs

Store OpenAI Chat Completions reasoning_effort and make it available to jinja templates (with model specific translations where required).

Assisted-by: llama.cpp:Muse-Glimmer-30B

  • server : fixup reading reasoning effort from body

server_chat_convert_responses_to_chatcmpl already handles conversion of Responses API reasoning.effort to reasoning_effort

  • chat : expose reasoning effort

Assisted-by: Claude Opus 5

  • chat : add reasoning_effort to generation_params

Assisted-by: Claude Opus 5

  • chat : move reasoning_effort next to enable_thinking

Assisted-by: Claude Opus 5

  • cont : mirror preserve_reasoning
  • cont : pass context through analyze function

---------

Co-authored-by: Alde Rojas

Website: -

UI: