MCPcopy Create free account

hub / github.com/abetlen/llama-cpp-python / functions

Functions1,336 in github.com/abetlen/llama-cpp-python

Method__init__
(self, scheduler: CompletionScheduler)
examples/server/server.py:12617
Method__init__
( self, model: Model, sequence_cache: Optional[SequenceCache] = None, )
examples/server/server.py:13087
Method__init__
(self, scheduler: CompletionScheduler)
examples/server/server.py:15464
Method__init__
(self, params: GptParams)
examples/low_level_api/low_level_api_chat_cpp.py:26
Method__init__
(self, pattern)
examples/low_level_api/util.py:14
Method__init__
(self, size, default=0)
examples/low_level_api/util.py:32
Method__iter__
(self)
llama_cpp/server/model.py:64
Method__setitem__
( self, key: Sequence[int], value: "llama_cpp.llama.LlamaState" )
llama_cpp/llama_cache.py:43
Method__setitem__
(self, key: Sequence[int], value: "llama_cpp.llama.LlamaState")
llama_cpp/llama_cache.py:91
Method__setitem__
(self, key: Sequence[int], value: "llama_cpp.llama.LlamaState")
llama_cpp/llama_cache.py:144
Method__setitem__
(self, model: str, settings: Union[ModelSettings, str, bytes])
llama_cpp/server/model.py:59
Method__setstate__
(self, state)
llama_cpp/llama.py:2196
Function_byref
Type-annotated version of ctypes.byref
llama_cpp/_ctypes_extensions.py:161
Method_call
(self, prompt: str, stop: Optional[List[str]] = None)
examples/high_level_api/langchain_custom_llm.py:22
Method_chat_chunk_payload
( *, chunk_id: str, created: int, model: str, index: int, delt
examples/server/server.py:7588
Method_chat_chunk_payload
( *, chunk_id: str, created: int, model: str, index: int, delt
examples/server/server.py:9758
Function_ctypes_function_from_names
Decorator for extension functions whose exported symbol name can vary by ABI.
llama_cpp/llama_cpp_ext.py:19
Method_find_longest_prefix_key
( self, key: Tuple[int, ...], )
llama_cpp/llama_cache.py:28
Method_from_json
(value: Any)
examples/server/server.py:3497
Method_identifying_params
(self)
examples/high_level_api/langchain_custom_llm.py:27
Method_input_ids
(self)
llama_cpp/llama.py:577
Method_llm_type
(self)
examples/high_level_api/langchain_custom_llm.py:14
Function_parse_bool_arg
(arg: str | bytes | bool)
llama_cpp/server/cli.py:55
Function_parse_json_object_arg
(arg: str | bytes)
llama_cpp/server/cli.py:72
Method_scores
(self)
llama_cpp/llama.py:581
Method_stream_state_message
(self, *, partial: bool)
examples/server/server.py:7533
Methodaccept
(self, ctx_main: LlamaContext, id: int, apply_grammar: bool)
llama_cpp/_internals.py:640
Methodaccept
(self, token: int)
llama_cpp/_internals.py:860
Methodaccept
(self, seq_id: int, accepted_draft_tokens: int)
examples/server/server.py:2370
Methodadd_component
(comp_schema, is_required)
llama_cpp/llama_grammar.py:747
Methodadd_component
(component_schema: Dict[str, Any], is_required: bool)
examples/server/server.py:571
Methodadd_dry
( self, model: LlamaModel, n_ctx_train: int, dry_multiplier: float, dr
llama_cpp/_internals.py:800
Methodadd_grammar_lazy_patterns
( self, model: LlamaModel, grammar: LlamaGrammar, trigger_patterns: List[str],
llama_cpp/_internals.py:759
Methodadd_infill
(self, model: LlamaModel)
llama_cpp/_internals.py:839
Methodadd_logit_bias
(self, n_vocab: int, logit_bias: Dict[int, float])
llama_cpp/_internals.py:827
Methodadd_softmax
(self)
llama_cpp/_internals.py:706
Methodadd_temp_ext
(self, t: float, delta: float, exponent: float)
llama_cpp/_internals.py:733
Methodadd_top_n_sigma
(self, n: float)
llama_cpp/_internals.py:741
Methodadd_xtc
(self, p: float, t: float, min_keep: int, seed: int)
llama_cpp/_internals.py:737
Methodadmit_request
(self, request: CompletionRequest)
examples/server/server.py:12703
Methodadmit_request
(self, request: CompletionRequest)
examples/server/server.py:12912
Methodapply_wrapper
( sampler: llama_cpp.llama_sampler_p, cur_p: llama_cpp.llama_token_data_array_p,
llama_cpp/_internals.py:648
Methodattention_partitioned
(self)
examples/server/server.py:11760
Functionauthenticate
( settings: Settings = Depends(get_server_settings), authorization: Optional[str] = Depends(bearer_sch
llama_cpp/server/app.py:241
Methodbatch_rows
(self)
examples/server/server.py:3871
Methodbatch_token_count
(self)
examples/server/server.py:13009
Methodcache_size
(self)
llama_cpp/llama_cache.py:25
Methodcache_size
(self)
llama_cpp/llama_cache.py:60
Methodcache_size
(self)
llama_cpp/llama_cache.py:114
Methodcan_admit
(self, request: CompletionRequest)
examples/server/server.py:12744
Methodcan_admit
(self, request: CompletionRequest)
examples/server/server.py:12814
Methodcan_admit
(self, request: CompletionRequest)
examples/server/server.py:12868
Methodcan_draft
(self, input_length: int, /, *, seq_id: int)
examples/server/server.py:1180
Methodcan_draft
(self, input_length: int, /, *, seq_id: int)
examples/server/server.py:1542
Methodcancel
(self, request_id: str)
examples/server/server.py:13348
Methodcancel_request
()
examples/server/server.py:15600
Methodcapture
(match: re.Match[str])
examples/server/server.py:4510
Functionchat_chunk_payloads
( completion_chunk: CompletionChunk, )
examples/server/server.py:16044
Functionchat_completion_handler
( *, llama: llama.Llama, messages: List[llama_types.ChatCompletionRequestMessage],
llama_cpp/llama_chat_format.py:613
Methodchat_handler_with_kwargs
(*args, **kwargs)
llama_cpp/server/model.py:328
Functionchatml_function_calling
( llama: llama.Llama, messages: List[llama_types.ChatCompletionRequestMessage], functions: Optiona
llama_cpp/llama_chat_format.py:4131
Functionclip_free
(ctx: clip_ctx_p, /)
llama_cpp/llava_cpp.py:154
Functionclip_model_load
( fname: bytes, verbosity: Union[c_int, int], / )
llama_cpp/llava_cpp.py:146
Methodclone
(self)
llama_cpp/_internals.py:866
Methodclose
(self)
examples/server/server.py:1204
Methodclose
(self)
examples/server/server.py:1389
Methodclose
(self)
examples/server/server.py:10382
Methodclose
(self)
examples/server/server.py:10622
Methodclose
(self)
examples/server/server.py:13336
Methodclose
(self)
examples/server/server.py:15477
Methodcollect_completion
(stream: Iterator[Any])
examples/server/server.py:7885
Methodcompletion_token_count
(self)
examples/server/server.py:3837
Methodcontext_length_exceeded
Formatter for context length exceeded error
llama_cpp/server/errors.py:48
Methodcopy
( self, source_sequence_id: int, dest_sequence_id: int, source_length: int,
examples/server/server.py:1099
Methodcopy_logits
(self, logits: npt.NDArray[np.single])
llama_cpp/_internals.py:548
Methodcopy_prompt_state
( self, source_sequence_id: int, dest_sequence_id: int, keep_len: int, )
examples/server/server.py:12800
Methodcopy_prompt_state
( self, source_sequence_id: int, dest_sequence_id: int, keep_len: int, )
examples/server/server.py:12843
Methodcopy_prompt_state
( self, source_sequence_id: int, dest_sequence_id: int, keep_len: int, )
examples/server/server.py:12950
Methodcopy_sequence
( self, source_seq_id: int, dest_seq_id: int, p0: int, p1: int, )
examples/server/server.py:2415
Functioncount_query_tokens
( body: TokenizeInputRequest, llama_proxy: LlamaProxy = Depends(get_llama_proxy), )
llama_cpp/server/app.py:576
Methodcp
(self)
llama_cpp/_internals.py:611
Functioncreate_chat_completion
( request: Request, body: CreateChatCompletionRequest = Body( openapi_examples={ "
llama_cpp/server/app.py:408
Functioncreate_chat_completion
( # pyright: ignore[reportUnusedFunction] http_request: Request, body: CreateChatCompletionRequest
examples/server/server.py:16009
Functioncreate_chat_completions
()
examples/batch-processing/server.py:30
Functioncreate_completion
( request: Request, body: CreateCompletionRequest, )
llama_cpp/server/app.py:303
Functioncreate_completion
( # pyright: ignore[reportUnusedFunction] http_request: Request, body: CreateCompletionReques
examples/server/server.py:15942
Functioncreate_embedding
( request: CreateEmbeddingRequest, llama_proxy: LlamaProxy = Depends(get_llama_proxy), )
llama_cpp/server/app.py:366
Functioncreate_embedding
( # pyright: ignore[reportUnusedFunction] body: CreateEmbeddingRequest, )
examples/server/server.py:15998
Methodcreate_embedding
Embed a string. Args: input: The utf-8 encoded string to embed. Returns: An embedding object.
llama_cpp/llama.py:1020
Methodcreate_embedding
( self, payload: CreateEmbeddingRequest, )
examples/server/server.py:13136
Functioncreate_response
( # pyright: ignore[reportUnusedFunction] http_request: Request, body: CreateResponseRequest,
examples/server/server.py:16087
Methodctx
(self)
llama_cpp/llama.py:569
Functionctypes_function
( name: str, argtypes: List[Any], restype: Any, enabled: bool = True )
llama_cpp/_ctypes_extensions.py:143
Methodcustom_route_handler
(request: Request)
llama_cpp/server/errors.py:170
Methoddecode
( cls, *, request_id: str, seq_id: int, start_pos:
examples/server/server.py:13055
Methoddecode_batch
(seq_sizes: List[int])
llama_cpp/llama.py:1108
Methoddecode_embedding_batch
()
examples/server/server.py:12232
Methoddecoder_pos_up_to
(self, pos: int)
examples/server/server.py:3993
Methoddecoder_position_increments
(self)
examples/server/server.py:3879
Functiondecorator
(f: F)
llama_cpp/_ctypes_extensions.py:146
← previousnext →701–800 of 1,336, ranked by callers