Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/facebookresearch/xformers
/ functions
Functions
1,445 in github.com/facebookresearch/xformers
⨍
Functions
1,445
◇
Types & classes
346
↳
Endpoints
17
Function
my_si_matmul
( grad_gathered_inputs: List[torch.Tensor], dst_rank: int, stream_factory:
xformers/ops/seqpar.py:99
Function
my_w_matmul
( gathered_inputs_shard: List[torch.Tensor], src_rank: int, stream_factory
xformers/ops/seqpar.py:123
Function
named_algorithms
xformers/csrc/sparse24/compute_sparse_tile.h:175
Method
nbytes
Number of bytes in the input, not counting the attention bias.
xformers/ops/fmha/common.py:335
Method
nbytes
Number of bytes in the input, not counting the attention bias.
xformers/ops/fmha/triton_splitk.py:105
Function
no_cuda_environment
(*args, **kwargs)
xformers/ops/fmha/cutlass_blackwell.py:42
Function
no_such_operator
(*args, **kwargs)
xformers/ops/common.py:12
Function
no_such_operator
(*args, **kwargs)
xformers/ops/fmha/cutlass_blackwell.py:35
Method
not_supported_reasons
(cls, d: Inputs)
xformers/ops/fmha/ck.py:399
Method
not_supported_reasons
(cls, d: Inputs)
xformers/ops/fmha/flash.py:727
Method
not_supported_reasons
(cls, d: Inputs)
xformers/ops/fmha/common.py:547
Method
not_supported_reasons
(cls, d: Inputs)
xformers/ops/fmha/flash3.py:802
Method
not_supported_reasons
(cls, d: Inputs)
xformers/ops/fmha/cutlass_blackwell.py:382
Method
not_supported_reasons
(cls, d: Inputs)
xformers/ops/fmha/ck_splitk.py:56
Method
not_supported_reasons
(cls, d: Inputs)
xformers/ops/fmha/cutlass.py:368
Method
not_supported_reasons
(cls, d: Inputs)
xformers/ops/fmha/triton_splitk.py:261
Method
operator()
xformers/csrc/attention/hip_decoder/ck_tile_attention_forward_decoder_splitk.h:90
Method
operator()
xformers/csrc/attention/hip_decoder/ck_tile_attention_forward_decoder_splitk.h:185
Method
operator()
xformers/csrc/attention/hip_fmha/ck_tiled_rand_uniform_kernel.h:287
Method
operator()
xformers/csrc/sparse24/static_sort.h:88
Method
operator()
xformers/csrc/sparse24/compute_sparse_tile.h:75
Method
operator()
xformers/csrc/sparse24/compute_sparse_tile.h:133
Method
operator<
xformers/csrc/sparse24/warp_tensor.h:321
Method
operator<
xformers/csrc/sparse24/compute_sparse_tile.h:43
Function
our_early_config_prune
(config, named_args, **kwargs)
xformers/ops/_triton/tiled_matmul_kernels.py:129
Function
our_estimate_matmul_time
Call into Triton's upstream cost model, with the right args The upstream function expects arguments to have certain names. Since we renamed a
xformers/ops/_triton/tiled_matmul_kernels.py:112
Method
outOfBoundsFillValue
xformers/csrc/sparse24/compute_sparse_tile.h:70
Method
outOfBoundsFillValue
xformers/csrc/sparse24/compute_sparse_tile.h:128
Method
pack_4x4
xformers/csrc/sparse24/sparse24_pack.h:202
Function
parse_one_file
(profile_trace_path: str)
xformers/profiler/find_slowest.py:106
Function
pattern_to_layout
r""" Given a mask pattern and blocksize, return the corresponding layout which makes sure that all the positives in the mask are covered
xformers/components/attention/attention_patterns.py:186
Method
pop_from_storage
(self, func, args, kwargs)
xformers/checkpoint.py:129
Function
pretty_barplot
Graph out the contents of a dict. Dash key means that if the result label has this key, then it will be displayed with a dash
xformers/benchmarks/utils.py:153
Function
profile
A pre-configured profiler that will run on the first ~20 steps of the training It will provide multiple traces that can be exploited later.
xformers/profiler/api.py:30
Function
rand_uniform_int
* generate a tensor with random uniform values. only used for testing, not much * attention is paid to performance */
xformers/csrc/attention/hip_fmha/attention_ck_rand_uniform.cpp:27
Function
random_pattern
(attn_size: int, sparsity: float)
xformers/components/attention/attention_patterns.py:77
Function
random_pattern_from_probability_matrix
(dist_matrix, nnz)
xformers/components/attention/attention_patterns.py:48
Method
reduce_line
xformers/csrc/sparse24/warp_tensor.h:295
Function
register_cls
(cls)
xformers/utils.py:43
Function
register_item
Registers a subclass. This decorator allows xFormers to instantiate a given subclass from a configuration file, even if the class its
xformers/utils.py:36
Function
register_operator
(cls: ClsT)
xformers/ops/common.py:49
Function
result
(nargs)
xformers/ops/_triton/tiled_matmul_kernels.py:21
Method
run
(self)
setup.py:363
Method
run
(cls)
xformers/fwbw_overlap.py:355
Function
run_batched_backward_mask_bias_dropout_dispatch
xformers/csrc/attention/hip_fmha/ck_tiled_fmha_batched_backward.h:356
Function
run_batched_forward_mask_bias_dropout_dispatch
xformers/csrc/attention/hip_fmha/ck_tiled_fmha_batched_forward.h:23
Function
run_batched_infer_mask_bias_dropout_dispatch
xformers/csrc/attention/hip_fmha/ck_tiled_fmha_batched_infer.h:23
Function
run_comms_lower_bound_ag
()
xformers/benchmarks/benchmark_sequence_parallel_fused.py:199
Function
run_comms_lower_bound_rs
()
xformers/benchmarks/benchmark_sequence_parallel_fused.py:202
Function
run_compute_lower_bound_ag
()
xformers/benchmarks/benchmark_sequence_parallel_fused.py:190
Function
run_compute_lower_bound_rs
()
xformers/benchmarks/benchmark_sequence_parallel_fused.py:194
Function
run_fused_nowait_ag
()
xformers/benchmarks/benchmark_sequence_parallel_fused.py:240
Function
run_fused_nowait_nomemcpy_ag
()
xformers/benchmarks/benchmark_sequence_parallel_fused.py:264
Function
run_fused_nowait_nomemcpy_rs
()
xformers/benchmarks/benchmark_sequence_parallel_fused.py:277
Function
run_fused_nowait_rs
()
xformers/benchmarks/benchmark_sequence_parallel_fused.py:252
Function
run_grouped_backward_mask_bias_dropout_dispatch
xformers/csrc/attention/hip_fmha/ck_tiled_fmha_grouped_backward.h:339
Function
run_grouped_forward_mask_bias_dropout_dispatch
xformers/csrc/attention/hip_fmha/ck_tiled_fmha_grouped_forward.h:23
Function
run_grouped_infer_mask_bias_dropout_dispatch
xformers/csrc/attention/hip_fmha/ck_tiled_fmha_grouped_infer.h:23
Function
run_one_rank
( my_rank, world_size, scenario_name, step, dtype_str, num_rounds, num_warmup_iter
xformers/benchmarks/benchmark_sequence_parallel_fused.py:120
Method
s
xformers/csrc/sparse24/static_sort.h:16
Method
scale_float
(self)
xformers/ops/fmha/common.py:164
Function
scaled_index_add
In-place scaling+index_add Indices in ``index`` are assumed to be unique The max index in ``index`` is assumed to be less than the size
xformers/ops/indexing.py:104
Function
scaled_index_add_bwd_kernel
( grad_output_ptr, # *Pointer* to input tensor. grad_source_ptr, # *Pointer* to index tensor. gr
xformers/ops/_triton/k_scaled_index_add.py:176
Function
scaled_index_add_fwd_kernel
( input_ptr, # *Pointer* to input tensor. index_ptr, # *Pointer* to index tensor. source_ptr, #
xformers/ops/_triton/k_scaled_index_add.py:14
Function
scatter_to_sequence_parallel_region
( x: torch.Tensor, process_group: Optional[torch.distributed.ProcessGroup] )
xformers/ops/differentiable_collectives.py:177
Function
selective_checkpoint_context_fn
An activation checkpoint context_fn for selectively deciding what to store and what to recompute. Accepts a custom policy. Args: polic
xformers/checkpoint.py:144
Function
sequence_parallel_leading_matmul_bwd_bridge
(ctx, grad_gathered_outputs)
xformers/ops/seqpar.py:187
Function
sequence_parallel_leading_matmul_bwd_fake
( scattered_input: torch.Tensor, weights: List[torch.Tensor], grad_gathered_outputs: List[torch.Te
xformers/ops/seqpar.py:170
Function
sequence_parallel_leading_matmul_fwd_fake
( scattered_input: torch.Tensor, weights: List[torch.Tensor], fuse: bool, process_group_name:
xformers/ops/seqpar.py:56
Function
sequence_parallel_leading_matmul_setup_context
(ctx, inputs, output)
xformers/ops/seqpar.py:180
Function
sequence_parallel_trailing_matmul_bwd_bridge
(ctx, grad_scattered_output)
xformers/ops/seqpar.py:333
Function
sequence_parallel_trailing_matmul_bwd_fake
( gathered_input: torch.Tensor, weight: torch.Tensor, grad_scattered_output: torch.Tensor, fus
xformers/ops/seqpar.py:316
Function
sequence_parallel_trailing_matmul_fwd_fake
( gathered_input: torch.Tensor, weight: torch.Tensor, fuse: bool, process_group_name: GroupNam
xformers/ops/seqpar.py:248
Function
sequence_parallel_trailing_matmul_setup_context
(ctx, inputs, output)
xformers/ops/seqpar.py:326
Function
set_autotuner_cache
( cache: Dict[Tuple[Union[int, str]], triton.Config], num_groups: int )
xformers/ops/fmha/_triton/splitk_kernels.py:692
Function
setup
(app)
docs/source/conf.py:136
Method
shape_not_supported_reasons
( cls, Mq: int, Mkv: int, K: int, Kv: int )
xformers/ops/fmha/cutlass_blackwell.py:405
Method
shape_not_supported_reasons
( cls, Mq: int, Mkv: int, K: int, Kv: int )
xformers/ops/fmha/triton_splitk.py:252
Method
sparse24_apply_kernel
xformers/csrc/sparse24/sparse24_pack.h:433
Function
sparse24_detach
(func, types, args, kwargs)
xformers/ops/sp24.py:213
Function
sparse24_linear
(func, types, args=(), kwargs=None)
xformers/ops/sp24.py:175
Function
sparse24_mm
(func, types, args=(), kwargs=None)
xformers/ops/sp24.py:140
Function
sparse24_pointwise_op
( func, types, args=(), kwargs=None, allow_sparsify_args_list=() )
xformers/ops/sp24.py:90
Method
sparse24_sparsify_both_ways_kernel
xformers/csrc/sparse24/sparse24_pack.h:302
Function
sparse24_t
(func, types, args=(), kwargs=None)
xformers/ops/sp24.py:188
Function
sparse24_view
(func, types, args=(), kwargs=None)
xformers/ops/sp24.py:203
Function
sparsify24
( x: torch.Tensor, algo: str = "", gradient: str = GRADIENT_SP24, backend: str = BACKEND_CUTLA
xformers/ops/sp24.py:774
Function
sparsify24_ste
2:4 sparsification, with Straight Through Estimator for the backward pass (eg the gradient is *not* sparsified). Optionally, `bw_mul[0-1]
xformers/ops/sp24.py:784
Method
sparsify_as
xformers/csrc/sparse24/warp_tensor.h:190
Method
split
( self, x: torch.Tensor, batch_sizes: Optional[Sequence[int]] = None )
xformers/ops/fmha/attn_bias.py:629
Method
split
( self, x: torch.Tensor, batch_sizes: Optional[Sequence[int]] = None )
xformers/ops/fmha/attn_bias.py:746
Method
split
The inverse operation of :attr:`BlockDiagonalCausalMask.from_tensor_list` Args: tensor (torch.Tensor): Tensor of tokens of shape
xformers/ops/fmha/attn_bias.py:942
Function
step
See `xformers.profiler.profile`
xformers/profiler/api.py:87
Method
step
(self)
xformers/profiler/profiler.py:48
Method
step
(self)
xformers/profiler/profiler.py:145
Method
step
(self)
xformers/profiler/profiler.py:211
Method
step
(self)
xformers/profiler/profiler_dcgm_impl.py:189
Method
step
(self)
xformers/profiler/profiler_dcgm.py:41
Method
store_32bits
xformers/csrc/sparse24/warp_tensor.h:86
Function
store_metadata_reordered
xformers/csrc/sparse24/warp_tensor.h:363
← previous
next →
1,001–1,100 of 1,445, ranked by callers