MCPcopy Create free account
hub / github.com/abetlen/llama-cpp-python / prefill

Method prefill

examples/server/server.py:13018–13052  ·  view source on GitHub ↗
(
            cls,
            *,
            request_id: str,
            seq_id: int,
            start_pos: int,
            llama_start_pos: int,
            tokens: List[int],
            identity_tokens: List[int],
            output_indices: List[Optional[int]],
            output_positions: List[int],
            position_increments: List[int],
            embeddings: Optional[np.ndarray] = None,
            positions: Optional[np.ndarray] = None,
            non_causal: bool = False,
            prompt_advance_to: Optional[int] = None,
        )

Source from the content-addressed store, hash-verified

13016
13017 @classmethod
13018 def prefill(
13019 cls,
13020 *,
13021 request_id: str,
13022 seq_id: int,
13023 start_pos: int,
13024 llama_start_pos: int,
13025 tokens: List[int],
13026 identity_tokens: List[int],
13027 output_indices: List[Optional[int]],
13028 output_positions: List[int],
13029 position_increments: List[int],
13030 embeddings: Optional[np.ndarray] = None,
13031 positions: Optional[np.ndarray] = None,
13032 non_causal: bool = False,
13033 prompt_advance_to: Optional[int] = None,
13034 ) -> "CompletionScheduler.BatchItem":
13035 return cls(
13036 kind="prefill",
13037 request_id=request_id,
13038 seq_id=seq_id,
13039 start_pos=start_pos,
13040 llama_start_pos=llama_start_pos,
13041 tokens=tokens,
13042 identity_tokens=identity_tokens,
13043 output_indices=output_indices,
13044 output_positions=output_positions,
13045 position_increments=position_increments,
13046 prefill_state=cls.Prefill(
13047 embeddings=embeddings,
13048 positions=positions,
13049 non_causal=non_causal,
13050 prompt_advance_to=prompt_advance_to,
13051 ),
13052 )
13053
13054 @classmethod
13055 def decode(

Callers 1

Calls

no outgoing calls

Tested by

no test coverage detected