(npartitions, split_every, split_out)
| 3990 | @pytest.mark.parametrize("split_every", [2, 5]) |
| 3991 | @pytest.mark.parametrize("split_out", [1, 5, 20]) |
| 3992 | def test_hash_split_unique(npartitions, split_every, split_out): |
| 3993 | from string import ascii_lowercase |
| 3994 | |
| 3995 | s = pd.Series(np.random.choice(list(ascii_lowercase), 1000, replace=True)) |
| 3996 | ds = dd.from_pandas(s, npartitions=npartitions) |
| 3997 | |
| 3998 | dropped = ds.unique(split_every=split_every, split_out=split_out) |
| 3999 | |
| 4000 | dsk = dropped.__dask_optimize__(dropped.dask, dropped.__dask_keys__()) |
| 4001 | from dask.core import get_deps |
| 4002 | |
| 4003 | dependencies, dependents = get_deps(dsk) |
| 4004 | |
| 4005 | assert dropped.npartitions == (split_out or 1) |
| 4006 | assert sorted(dropped.compute(scheduler="sync")) == sorted(s.unique()) |
| 4007 | |
| 4008 | |
| 4009 | @pytest.mark.parametrize("split_every", [None, 2]) |
nothing calls this directly
no test coverage detected