MCPcopy Create free account

hub / github.com/facebookresearch/xformers / functions

Functions1,445 in github.com/facebookresearch/xformers

Functionmy_si_matmul
( grad_gathered_inputs: List[torch.Tensor], dst_rank: int, stream_factory:
xformers/ops/seqpar.py:99
Functionmy_w_matmul
( gathered_inputs_shard: List[torch.Tensor], src_rank: int, stream_factory
xformers/ops/seqpar.py:123
Functionnamed_algorithms
xformers/csrc/sparse24/compute_sparse_tile.h:175
Methodnbytes
Number of bytes in the input, not counting the attention bias.
xformers/ops/fmha/common.py:335
Methodnbytes
Number of bytes in the input, not counting the attention bias.
xformers/ops/fmha/triton_splitk.py:105
Functionno_cuda_environment
(*args, **kwargs)
xformers/ops/fmha/cutlass_blackwell.py:42
Functionno_such_operator
(*args, **kwargs)
xformers/ops/common.py:12
Functionno_such_operator
(*args, **kwargs)
xformers/ops/fmha/cutlass_blackwell.py:35
Methodnot_supported_reasons
(cls, d: Inputs)
xformers/ops/fmha/ck.py:399
Methodnot_supported_reasons
(cls, d: Inputs)
xformers/ops/fmha/flash.py:727
Methodnot_supported_reasons
(cls, d: Inputs)
xformers/ops/fmha/common.py:547
Methodnot_supported_reasons
(cls, d: Inputs)
xformers/ops/fmha/flash3.py:802
Methodnot_supported_reasons
(cls, d: Inputs)
xformers/ops/fmha/cutlass_blackwell.py:382
Methodnot_supported_reasons
(cls, d: Inputs)
xformers/ops/fmha/ck_splitk.py:56
Methodnot_supported_reasons
(cls, d: Inputs)
xformers/ops/fmha/cutlass.py:368
Methodnot_supported_reasons
(cls, d: Inputs)
xformers/ops/fmha/triton_splitk.py:261
Methodoperator()
xformers/csrc/attention/hip_decoder/ck_tile_attention_forward_decoder_splitk.h:90
Methodoperator()
xformers/csrc/attention/hip_decoder/ck_tile_attention_forward_decoder_splitk.h:185
Methodoperator()
xformers/csrc/attention/hip_fmha/ck_tiled_rand_uniform_kernel.h:287
Methodoperator()
xformers/csrc/sparse24/static_sort.h:88
Methodoperator()
xformers/csrc/sparse24/compute_sparse_tile.h:75
Methodoperator()
xformers/csrc/sparse24/compute_sparse_tile.h:133
Methodoperator<
xformers/csrc/sparse24/warp_tensor.h:321
Methodoperator<
xformers/csrc/sparse24/compute_sparse_tile.h:43
Functionour_early_config_prune
(config, named_args, **kwargs)
xformers/ops/_triton/tiled_matmul_kernels.py:129
Functionour_estimate_matmul_time
Call into Triton's upstream cost model, with the right args The upstream function expects arguments to have certain names. Since we renamed a
xformers/ops/_triton/tiled_matmul_kernels.py:112
MethodoutOfBoundsFillValue
xformers/csrc/sparse24/compute_sparse_tile.h:70
MethodoutOfBoundsFillValue
xformers/csrc/sparse24/compute_sparse_tile.h:128
Methodpack_4x4
xformers/csrc/sparse24/sparse24_pack.h:202
Functionparse_one_file
(profile_trace_path: str)
xformers/profiler/find_slowest.py:106
Functionpattern_to_layout
r""" Given a mask pattern and blocksize, return the corresponding layout which makes sure that all the positives in the mask are covered
xformers/components/attention/attention_patterns.py:186
Methodpop_from_storage
(self, func, args, kwargs)
xformers/checkpoint.py:129
Functionpretty_barplot
Graph out the contents of a dict. Dash key means that if the result label has this key, then it will be displayed with a dash
xformers/benchmarks/utils.py:153
Functionprofile
A pre-configured profiler that will run on the first ~20 steps of the training It will provide multiple traces that can be exploited later.
xformers/profiler/api.py:30
Functionrand_uniform_int
* generate a tensor with random uniform values. only used for testing, not much * attention is paid to performance */
xformers/csrc/attention/hip_fmha/attention_ck_rand_uniform.cpp:27
Functionrandom_pattern
(attn_size: int, sparsity: float)
xformers/components/attention/attention_patterns.py:77
Functionrandom_pattern_from_probability_matrix
(dist_matrix, nnz)
xformers/components/attention/attention_patterns.py:48
Methodreduce_line
xformers/csrc/sparse24/warp_tensor.h:295
Functionregister_cls
(cls)
xformers/utils.py:43
Functionregister_item
Registers a subclass. This decorator allows xFormers to instantiate a given subclass from a configuration file, even if the class its
xformers/utils.py:36
Functionregister_operator
(cls: ClsT)
xformers/ops/common.py:49
Functionresult
(nargs)
xformers/ops/_triton/tiled_matmul_kernels.py:21
Methodrun
(self)
setup.py:363
Methodrun
(cls)
xformers/fwbw_overlap.py:355
Functionrun_batched_backward_mask_bias_dropout_dispatch
xformers/csrc/attention/hip_fmha/ck_tiled_fmha_batched_backward.h:356
Functionrun_batched_forward_mask_bias_dropout_dispatch
xformers/csrc/attention/hip_fmha/ck_tiled_fmha_batched_forward.h:23
Functionrun_batched_infer_mask_bias_dropout_dispatch
xformers/csrc/attention/hip_fmha/ck_tiled_fmha_batched_infer.h:23
Functionrun_comms_lower_bound_ag
()
xformers/benchmarks/benchmark_sequence_parallel_fused.py:199
Functionrun_comms_lower_bound_rs
()
xformers/benchmarks/benchmark_sequence_parallel_fused.py:202
Functionrun_compute_lower_bound_ag
()
xformers/benchmarks/benchmark_sequence_parallel_fused.py:190
Functionrun_compute_lower_bound_rs
()
xformers/benchmarks/benchmark_sequence_parallel_fused.py:194
Functionrun_fused_nowait_ag
()
xformers/benchmarks/benchmark_sequence_parallel_fused.py:240
Functionrun_fused_nowait_nomemcpy_ag
()
xformers/benchmarks/benchmark_sequence_parallel_fused.py:264
Functionrun_fused_nowait_nomemcpy_rs
()
xformers/benchmarks/benchmark_sequence_parallel_fused.py:277
Functionrun_fused_nowait_rs
()
xformers/benchmarks/benchmark_sequence_parallel_fused.py:252
Functionrun_grouped_backward_mask_bias_dropout_dispatch
xformers/csrc/attention/hip_fmha/ck_tiled_fmha_grouped_backward.h:339
Functionrun_grouped_forward_mask_bias_dropout_dispatch
xformers/csrc/attention/hip_fmha/ck_tiled_fmha_grouped_forward.h:23
Functionrun_grouped_infer_mask_bias_dropout_dispatch
xformers/csrc/attention/hip_fmha/ck_tiled_fmha_grouped_infer.h:23
Functionrun_one_rank
( my_rank, world_size, scenario_name, step, dtype_str, num_rounds, num_warmup_iter
xformers/benchmarks/benchmark_sequence_parallel_fused.py:120
Methods
xformers/csrc/sparse24/static_sort.h:16
Methodscale_float
(self)
xformers/ops/fmha/common.py:164
Functionscaled_index_add
In-place scaling+index_add Indices in ``index`` are assumed to be unique The max index in ``index`` is assumed to be less than the size
xformers/ops/indexing.py:104
Functionscaled_index_add_bwd_kernel
( grad_output_ptr, # *Pointer* to input tensor. grad_source_ptr, # *Pointer* to index tensor. gr
xformers/ops/_triton/k_scaled_index_add.py:176
Functionscaled_index_add_fwd_kernel
( input_ptr, # *Pointer* to input tensor. index_ptr, # *Pointer* to index tensor. source_ptr, #
xformers/ops/_triton/k_scaled_index_add.py:14
Functionscatter_to_sequence_parallel_region
( x: torch.Tensor, process_group: Optional[torch.distributed.ProcessGroup] )
xformers/ops/differentiable_collectives.py:177
Functionselective_checkpoint_context_fn
An activation checkpoint context_fn for selectively deciding what to store and what to recompute. Accepts a custom policy. Args: polic
xformers/checkpoint.py:144
Functionsequence_parallel_leading_matmul_bwd_bridge
(ctx, grad_gathered_outputs)
xformers/ops/seqpar.py:187
Functionsequence_parallel_leading_matmul_bwd_fake
( scattered_input: torch.Tensor, weights: List[torch.Tensor], grad_gathered_outputs: List[torch.Te
xformers/ops/seqpar.py:170
Functionsequence_parallel_leading_matmul_fwd_fake
( scattered_input: torch.Tensor, weights: List[torch.Tensor], fuse: bool, process_group_name:
xformers/ops/seqpar.py:56
Functionsequence_parallel_leading_matmul_setup_context
(ctx, inputs, output)
xformers/ops/seqpar.py:180
Functionsequence_parallel_trailing_matmul_bwd_bridge
(ctx, grad_scattered_output)
xformers/ops/seqpar.py:333
Functionsequence_parallel_trailing_matmul_bwd_fake
( gathered_input: torch.Tensor, weight: torch.Tensor, grad_scattered_output: torch.Tensor, fus
xformers/ops/seqpar.py:316
Functionsequence_parallel_trailing_matmul_fwd_fake
( gathered_input: torch.Tensor, weight: torch.Tensor, fuse: bool, process_group_name: GroupNam
xformers/ops/seqpar.py:248
Functionsequence_parallel_trailing_matmul_setup_context
(ctx, inputs, output)
xformers/ops/seqpar.py:326
Functionset_autotuner_cache
( cache: Dict[Tuple[Union[int, str]], triton.Config], num_groups: int )
xformers/ops/fmha/_triton/splitk_kernels.py:692
Functionsetup
(app)
docs/source/conf.py:136
Methodshape_not_supported_reasons
( cls, Mq: int, Mkv: int, K: int, Kv: int )
xformers/ops/fmha/cutlass_blackwell.py:405
Methodshape_not_supported_reasons
( cls, Mq: int, Mkv: int, K: int, Kv: int )
xformers/ops/fmha/triton_splitk.py:252
Methodsparse24_apply_kernel
xformers/csrc/sparse24/sparse24_pack.h:433
Functionsparse24_detach
(func, types, args, kwargs)
xformers/ops/sp24.py:213
Functionsparse24_linear
(func, types, args=(), kwargs=None)
xformers/ops/sp24.py:175
Functionsparse24_mm
(func, types, args=(), kwargs=None)
xformers/ops/sp24.py:140
Functionsparse24_pointwise_op
( func, types, args=(), kwargs=None, allow_sparsify_args_list=() )
xformers/ops/sp24.py:90
Methodsparse24_sparsify_both_ways_kernel
xformers/csrc/sparse24/sparse24_pack.h:302
Functionsparse24_t
(func, types, args=(), kwargs=None)
xformers/ops/sp24.py:188
Functionsparse24_view
(func, types, args=(), kwargs=None)
xformers/ops/sp24.py:203
Functionsparsify24
( x: torch.Tensor, algo: str = "", gradient: str = GRADIENT_SP24, backend: str = BACKEND_CUTLA
xformers/ops/sp24.py:774
Functionsparsify24_ste
2:4 sparsification, with Straight Through Estimator for the backward pass (eg the gradient is *not* sparsified). Optionally, `bw_mul[0-1]
xformers/ops/sp24.py:784
Methodsparsify_as
xformers/csrc/sparse24/warp_tensor.h:190
Methodsplit
( self, x: torch.Tensor, batch_sizes: Optional[Sequence[int]] = None )
xformers/ops/fmha/attn_bias.py:629
Methodsplit
( self, x: torch.Tensor, batch_sizes: Optional[Sequence[int]] = None )
xformers/ops/fmha/attn_bias.py:746
Methodsplit
The inverse operation of :attr:`BlockDiagonalCausalMask.from_tensor_list` Args: tensor (torch.Tensor): Tensor of tokens of shape
xformers/ops/fmha/attn_bias.py:942
Functionstep
See `xformers.profiler.profile`
xformers/profiler/api.py:87
Methodstep
(self)
xformers/profiler/profiler.py:48
Methodstep
(self)
xformers/profiler/profiler.py:145
Methodstep
(self)
xformers/profiler/profiler.py:211
Methodstep
(self)
xformers/profiler/profiler_dcgm_impl.py:189
Methodstep
(self)
xformers/profiler/profiler_dcgm.py:41
Methodstore_32bits
xformers/csrc/sparse24/warp_tensor.h:86
Functionstore_metadata_reordered
xformers/csrc/sparse24/warp_tensor.h:363
← previousnext →1,001–1,100 of 1,445, ranked by callers