MCPcopy Create free account

hub / github.com/claw-bench/claw-bench / functions

Functions7,113 in github.com/claw-bench/claw-bench

Functionreport
(workspace)
tasks/data-analysis/data-009/verifier/test_output.py:24
Functionreport
(workspace)
tasks/data-analysis/data-011/verifier/test_output.py:14
Functionreport
Load and return the audit_report.json contents.
tasks/system-admin/sys-006-config-file-audit/verifier/test_output.py:16
Functionreport
Load and return the dependency_order.json contents.
tasks/system-admin/sys-007-service-dependency-mapping/verifier/test_output.py:33
Functionreport
(workspace)
tasks/system-admin/sys-011-disk-usage-analyzer/verifier/test_output.py:15
Functionreport
(workspace)
tasks/system-admin/sys-015-network-config-validator/verifier/test_output.py:15
Functionreport
Load and return the report.json contents.
tasks/system-admin/sys-001-disk-usage-report/verifier/test_output.py:16
Functionreport
Load and return the cron_explained.json contents.
tasks/system-admin/sys-005-cron-expression-parser/verifier/test_output.py:17
Functionreport
Load and return the log_analysis.json contents.
tasks/system-admin/sys-004-log-analysis/verifier/test_output.py:16
Functionreport
Load and return the diagnosis.json contents.
tasks/system-admin/sys-009-performance-diagnostic/verifier/test_output.py:16
Functionreport
Load and return the port_report.json contents.
tasks/system-admin/sys-003-check-port-availability/verifier/test_output.py:16
Functionreport
Load and return the top_processes.json contents.
tasks/system-admin/sys-002-parse-process-list/verifier/test_output.py:16
Functionreport
(workspace)
tasks/system-admin/sys-012-cron-parser/verifier/test_output.py:15
Functionreport
Load and return the compliance report JSON.
tasks/security/sec-014-compliance-audit/verifier/test_output.py:16
Functionreport
Load and return the XSS report JSON.
tasks/security/sec-005-xss-vulnerability-scan/verifier/test_output.py:16
Functionreport
Load and return the secrets report JSON.
tasks/security/sec-012-secrets-scanning-git-history/verifier/test_output.py:16
Functionreport
Load and return the routing_report.md contents.
tasks/email/eml-012-complex-workflow/verifier/test_output.py:25
Functionreport
Load and return the expense_report.json contents.
tasks/email/eml-018-expense-receipt-emails/verifier/test_output.py:16
Functionreport
Read and return the parsed weekly_report.json.
tasks/document-editing/doc-017-weekly-status-report/verifier/test_output.py:16
Functionreport
()
tasks/cross-domain/xdom-013-incident-response-pipeline/verifier/test_output.py:28
Functionreport
(workspace)
tasks/web-browsing/web-015-cookie-policy-analyzer/verifier/test_output.py:15
Functionreport
(workspace)
tasks/web-browsing/web-007-seo-analysis/verifier/test_output.py:15
Functionreport
(workspace)
tasks/web-browsing/web-006-accessibility-audit/verifier/test_output.py:15
Functionreport
Read and parse the sentiment_report.json.
tasks/communication/comm-014-chat-sentiment-analysis/verifier/test_output.py:16
Functionreport
(workspace)
tasks/communication/comm-008-communication-audit/verifier/test_output.py:22
Functionreport_cmd
Generate a comprehensive benchmark report from results.
src/claw_bench/cli/report.py:15
Functionreport_html
(workspace)
tasks/cross-domain/xdom-007-multi-format-conversion/verifier/test_output.py:14
Functionreport_md
Read and return the generated report.md contents.
tasks/file-operations/file-013-multi-file-search/verifier/test_output.py:15
Functionreport_rows
Read and return rows from activity_report.csv.
tasks/communication/comm-015-channel-activity-report/verifier/test_output.py:16
Functionreport_text
(workspace)
tasks/multimodal/mm-004-log-analysis-config/verifier/test_output.py:14
Functionreport_text
(workspace)
tasks/multimodal/mm-009-markdown-report/verifier/test_output.py:18
Functionreport_txt
Read and return the generated report.txt contents.
tasks/document-editing/doc-013-csv-report-formatter/verifier/test_output.py:16
Functionresolved_content
(workspace)
tasks/real-tools/tool-002/verifier/test_output.py:27
Functionresolved_packages
(resolved_content)
tasks/real-tools/tool-002/verifier/test_output.py:34
Functionresponse_plan
Load and return the response plan markdown.
tasks/security/sec-011-incident-response-plan/verifier/test_output.py:16
Functionresult
(workspace)
tasks/system-admin/sys-014-service-dependency-resolver/verifier/test_output.py:15
Functionresult
(workspace)
tasks/accounting/acct-004-bank-reconciliation/verifier/test_output.py:12
Functionresult
(workspace)
tasks/document-editing/doc-004-find-replace/verifier/test_output.py:14
Functionresult
(workspace)
tasks/contract-review/law-001-nda-clause-extract/verifier/test_output.py:14
Functionresult
(workspace)
tasks/financial-analysis/fin-003-risk-metrics/verifier/test_output.py:12
Functionresult
(workspace)
tasks/financial-analysis/fin-001-portfolio-beta/verifier/test_output.py:14
Functionresult
(workspace)
tasks/financial-analysis/fin-002-dcf-valuation/verifier/test_output.py:12
Functionresult
(workspace)
tasks/financial-analysis/fin-005-forex-arbitrage/verifier/test_output.py:12
Functionresult
(workspace)
tasks/educational-assessment/edu-005-assessment-generation/verifier/test_output.py:12
Functionresult
(workspace)
tasks/educational-assessment/edu-003-learning-path/verifier/test_output.py:12
Functionresult_data
(workspace)
tasks/multimodal/mm-005-multi-format-pipeline/verifier/test_output.py:15
Functionresults
Load the results JSON.
tasks/workflow-automation/wfl-002-sequential-task-execution/verifier/test_output.py:16
Functionresults
Load and return the results JSON.
tasks/security/sec-002-validate-password-strength/verifier/test_output.py:16
Functionresults_dir
Create a valid results directory with results.json.
tests/unit/test_submit_cli.py:15
Functionresults_json
(workspace)
tasks/database/db-001/verifier/test_output.py:34
Functionresults_json
(workspace)
tasks/database/db-002/verifier/test_output.py:43
Functionreverse_words
(text)
tasks/multi-agent/mag-001-code-review-pipeline/environment/data/text_utils.py:20
Functionreview
(workspace)
tasks/cross-domain/xdom-002-code-review-report/verifier/test_output.py:15
Functionreview
()
tasks/cross-domain/xdom-015-automated-code-review-report/verifier/test_output.py:27
Functionreview_summary
(workspace)
tasks/cross-domain/xdom-002-code-review-report/verifier/test_output.py:23
Functionrevise_proposal
Expert requests revisions — adds notes and re-triggers generation.
src/claw_bench/server/admin.py:787
Functionrisk
Load and return the risk_assessment.json contents.
tasks/system-admin/sys-010-infrastructure-migration-plan/verifier/test_output.py:46
Functionrollback_plan
(workspace)
tasks/cross-domain/xdom-011-data-migration-plan/verifier/test_output.py:39
Functionroot_cause
(workspace)
tasks/cross-domain/xdom-010-incident-response/verifier/test_output.py:23
Functionrouted
(workspace)
tasks/communication/comm-010-notification-router/verifier/test_output.py:15
Functionrouted
(workspace)
tasks/communication/comm-005-notification-routing/verifier/test_output.py:15
Functionrouted_map
Map event_id to routing result for easy lookup.
tasks/communication/comm-010-notification-router/verifier/test_output.py:22
Functionrules
Load original rules.
tasks/workflow-automation/wfl-006-event-driven-workflow/verifier/test_output.py:31
Functionrun_cmd
Run benchmark tasks through an adapter. For OpenClaw smoke testing, use ``claw-bench run -f openclaw -t quick``. The OpenClaw adapter can run
src/claw_bench/cli/run.py:186
Functionrun_diagnostic
Run a diagnostic command.
tasks/cross-domain/xdom-008-security-audit-remediation/environment/data/api.py:14
Functionrun_model
Run up to MAX_TASKS tasks for one model.
scripts/run_benchmark_50.py:105
Functionrun_model
Run all tasks for a single model and return results dict.
scripts/run_full_benchmark.py:41
Functionsafe_divide
Divide a by b, returning default if b is zero.
tasks/code-assistance/code-003-add-type-annotations/environment/data/utils.py:36
Functionsafe_get
Safely get a value from a dictionary. Args: data: The dictionary to access. key: The key to look up. Supports dot notation for ne
tasks/cross-domain/xdom-012-automated-docs-generator/environment/data/utils.py:118
Functionsafe_sqrt
Compute the square root of n, returning None for negative inputs. Expected: safe_sqrt(4) == 2.0, safe_sqrt(0) == 0.0, safe_sqrt(-1) == None B
tasks/code-assistance/code-009-debug-calculator/environment/data/calculator.py:32
Functionsample_results
Run 3 tasks with DryRun adapter to get real TaskResult objects.
tests/integration/test_statistics_pipeline.py:29
FunctionsaveAgent
()
leaderboard/src/app/admin/page.tsx:369
FunctionsaveResult
()
leaderboard/src/app/admin/page.tsx:342
FunctionsaveSkillsGain
()
leaderboard/src/app/admin/page.tsx:353
Functionsave_config
Save configuration to a file.
tasks/cross-domain/xdom-002-code-review-report/environment/data/pull_request.py:42
Functionsave_skills_gain
(entries: List[SkillsGainInput], _: str = Depends(verify_admin))
src/claw_bench/server/admin.py:182
Functionscaling_strategy
(architecture)
tasks/planning/plan-005/verifier/test_output.py:46
Functionschedule
Load the schedule.
tasks/workflow-automation/wfl-009-scheduled-workflow-plan/verifier/test_output.py:16
Functionschedule
(workspace)
tasks/workflow-automation/wfl-013-task-scheduler/verifier/test_output.py:15
Functionschedule_by_id
Create lookup by task ID.
tasks/workflow-automation/wfl-009-scheduled-workflow-plan/verifier/test_output.py:38
Functionschema_docs
(workspace)
tasks/multimodal/mm-010-db-schema-docs/verifier/test_output.py:15
Functionschema_sql
(workspace)
tasks/database/db-003/verifier/test_output.py:16
Functionschema_sql
(workspace)
tasks/database/db-005/verifier/test_output.py:25
Methodscore_range
(cls, v: float)
src/claw_bench/server/submit_api.py:693
Functionscript
Read and return the rotate.sh contents.
tasks/system-admin/sys-008-log-rotation-script/verifier/test_output.py:24
Functionscript_content
(script_path)
tasks/real-tools/tool-001/verifier/test_output.py:22
Functionscript_path
(workspace)
tasks/real-tools/tool-001/verifier/test_output.py:17
Functionsearch_logs
Search through application logs.
tasks/cross-domain/xdom-008-security-audit-remediation/environment/data/api.py:20
Functionsearch_products
Search products by category and price — VULNERABLE (format string).
tasks/security/sec-004-sql-injection-detection/environment/data/queries.py:60
Functionsearch_users
Search users by name.
tasks/security/sec-015-full-security-assessment/environment/data/app.py:34
Functionsearch_users_by_name
Search for users by name — VULNERABLE (f-string).
tasks/security/sec-004-sql-injection-detection/environment/data/queries.py:19
Functionselect_track_tasks
Select all tasks in a single domain for a deep-dive evaluation.
src/claw_bench/core/test_tiers.py:110
Methodsend_message
(self, message: str, attachments: list | None = None)
tests/integration/test_full_pipeline.py:36
Methodsend_message
(self, message, attachments=None)
tests/unit/test_adapters.py:62
Methodsend_message
(self, message, attachments=None)
tests/unit/test_runner_edge_cases.py:31
Methodsend_message
(self, message, attachments=None)
tests/unit/test_runner_edge_cases.py:147
Functionsend_notification
Send a notification to the user via the messaging service.
tasks/security/sec-001-detect-hardcoded-credentials/environment/data/auth_service.py:54
Functionsender_counts
Load and return the sender_counts.json contents.
tasks/email/eml-003-count-by-sender/verifier/test_output.py:16
Functionservices
(workspace)
tasks/system-admin/sys-014-service-dependency-resolver/verifier/test_output.py:23
Functionset_task_gen_model
Set the active model for task generation.
src/claw_bench/server/task_generator.py:569
← previousnext →1,001–1,100 of 7,113, ranked by callers