Team Ai
Modelpublic

Felipe97/llama-cpp-compiled

sourceHugging Faceupdated 21d agoView on Hugging Face
0likes1.2kdownloads
muse-glimmer.cpp139 linesDownload Raw Back to parsers
1#include "parsers.h"2 3// An assistant turn is rendered as one or more messages, each4// "<|start|>assistant to=<recipient><|message|>{content}{END}" where END is5// <|eom|> (more messages follow) or <|eot|> (end of turn):6//   - chain-of-thought: to=self, terminated by <|eom|>7//   - final answer:     to=user, terminated by <|eot|>8// The generation prompt is just "<|start|>assistant"; the model emits its own9// " to=...<|message|>".10common_chat_params common_chat_params_init_muse_glimmer(const common_chat_template &          tmpl,11                                                               const autoparser::generation_params & inputs) {12    common_chat_params data;13 14    data.prompt            = common_chat_template_direct_apply_impl(tmpl, inputs);15    data.generation_prompt = "<|start|>assistant";16    data.format            = COMMON_CHAT_FORMAT_PEG_NATIVE;17    data.supports_thinking = true;18 19    data.preserved_tokens = {20        "<|start|>", "<|message|>", "<|eom|>", "<|eot|>",21        // ATEM tool-call markup emitted on " to=<tool>" turns.22        "<atem:function_calls>", "<atem:invoke", "<atem:parameter", "</atem:parameter>",23        "</atem:invoke>", "</atem:function_calls>",24    };25 26    data.message_delimiters = {27        { COMMON_CHAT_ROLE_ASSISTANT, "<|start|>assistant" },28        { COMMON_CHAT_ROLE_USER,      "<|start|>user"      },29        { COMMON_CHAT_ROLE_SYSTEM,    "<|start|>system"    },30        { COMMON_CHAT_ROLE_TOOL,      "<|start|>tool"      },31    };32 33    if (inputs.has_continuation()) {34        const auto & msg = inputs.continue_msg;35 36        data.generation_prompt = "<|start|>assistant to=self<|message|>" + msg.reasoning_content;37        if (inputs.continue_final_message == COMMON_CHAT_CONTINUATION_CONTENT) {38            data.generation_prompt += "<|eom|><|start|>assistant to=user<|message|>" + msg.render_content();39        }40 41        data.prompt += data.generation_prompt;42    }43 44    auto extract_reasoning = inputs.reasoning_format != COMMON_REASONING_FORMAT_NONE;45 46    auto has_tools = inputs.tools.is_array() && !inputs.tools.empty();47    // Constrained grammar whenever tools are offered.48    auto include_grammar = has_tools && inputs.tool_choice != COMMON_CHAT_TOOL_CHOICE_NONE;49 50    auto parser = build_chat_peg_parser([&](common_chat_peg_builder & p) {51        auto start = p.rule("start", p.literal("<|start|>assistant"));52 53        if (!extract_reasoning && !include_grammar) {54            return start + p.content(p.rest());55        }56 57        if (extract_reasoning) {58            p.rule("analysis", p.literal(" to=self<|message|>") + p.reasoning(p.until("<|eom|>")) + p.literal("<|eom|>"));59        } else {60            p.rule("analysis", p.literal(" to=self<|message|>") + p.content(p.until("<|eom|>")) + p.literal("<|eom|>"));61        }62        auto analysis = p.ref("analysis");63 64        auto recipient  = p.optional(p.literal(" to=user"));65        auto final_msg  = p.rule("final", recipient + p.literal("<|message|>") +66                                              p.content(p.until_one_of({ "<|eot|>", "<|eom|>" })));67 68        if (has_tools && inputs.tool_choice != COMMON_CHAT_TOOL_CHOICE_NONE) {69            auto string_value = p.ac(70                p.tool_arg_string_value(p.until("</atem:parameter>")) + p.tool_arg_close(p.literal("</atem:parameter>")),71                "</atem:parameter>");72 73            auto tool_choice = p.choice();74            foreach_function(inputs.tools, [&](const json & tool) {75                const auto &      function = tool.at("function");76                const std::string name     = function.at("name");77 78                std::vector<common_peg_parser> arg_rules;79                foreach_parameter(function, [&](const common_chat_schema_property & prop, const common_chat_schema_document_ptr & doc) {80                    auto value_parser = p.eps();81                    if (prop.schema->may_be_string()) {82                        value_parser = string_value;83                    } else {84                        value_parser = p.tool_arg_json_value(85                                p.schema(p.json(), "tool-" + name + "-arg-" + prop.name + "-schema", doc, *prop.schema))86                            + p.tool_arg_close(p.literal("</atem:parameter>"));87                    }88 89                    arg_rules.push_back(p.tool_arg(90                        p.tool_arg_open(p.literal("<atem:parameter name=\"") + p.tool_arg_name(p.literal(prop.name)) + p.literal("\">")) +91                        value_parser));92                });93 94                auto args = p.eps();95                if (!arg_rules.empty()) {96                    args = p.zero_or_more(p.choice(arg_rules) + p.space());97                }98 99                auto tool_parser = p.tool(100                    p.tool_open(p.literal(" to=") + p.until("<|message|>") +101                                p.literal("<|message|><atem:function_calls>") + p.space() +102                                p.literal("<atem:invoke name=\"") + p.tool_name(p.literal(name)) + p.literal("\">") + p.space())103                    << p.tool_args(args)104                    << p.tool_close(p.literal("</atem:invoke>") + p.space() + p.literal("</atem:function_calls>")));105 106                tool_choice |= p.rule("tool-" + name, tool_parser);107            });108 109            auto tool_calls = inputs.parallel_tool_calls110                ? p.trigger_rule("tool-call", tool_choice + p.zero_or_more(p.literal("<|eom|>") + start + tool_choice))111                : p.trigger_rule("tool-call", tool_choice);112 113 114            if (inputs.tool_choice == COMMON_CHAT_TOOL_CHOICE_REQUIRED) {115                return p.zero_or_more(start + analysis) + start + tool_calls;116            }117            auto trailing_calls = p.optional(p.literal("<|eom|>") + start + tool_calls);118            return p.zero_or_more(start + analysis) + start + (tool_calls | (final_msg + trailing_calls));119        }120 121        return p.zero_or_more(start + analysis) + start + final_msg;122    });123 124    data.parser = parser.save();125 126    if (include_grammar) {127        data.grammar_lazy = inputs.tool_choice != COMMON_CHAT_TOOL_CHOICE_REQUIRED;128        data.grammar      = build_grammar([&](const common_grammar_builder & builder) {129            parser.build_grammar(builder, data.grammar_lazy);130        });131        data.grammar_triggers = {132            { COMMON_GRAMMAR_TRIGGER_TYPE_PATTERN,133              "<\\|start\\|>assistant( to=(?!self<\\|message\\|>)(?!user<\\|message\\|>)[^<]*?<\\|message\\|>)" },134        };135    }136 137    return data;138}139