Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/microsoft/fara
/ types & classes
Types & classes
122 in github.com/microsoft/fara
⨍
Functions
650
◇
Types & classes
122
↳
Endpoints
17
↓ 12 callers
Class
RequestUsage
Token usage statistics for a single model call.
webeval/src/webeval/oai_clients/messages.py:60
↓ 9 callers
Class
UserMessage
webeval/src/webeval/oai_clients/messages.py:27
↓ 7 callers
Class
ContentItem
src/fara/qwen_helpers/schema.py:68
↓ 5 callers
Class
EvalResult
webeval/src/webeval/eval_result.py:14
↓ 5 callers
Class
ParseResult
Result of parsing LLM output.
webeval/src/webeval/rubric_agent/_yaml_utils.py:34
↓ 4 callers
Class
CreateResult
Result from a chat completion call. ``content`` is the textual response. The provider's full message object is preserved in ``message`` for c
webeval/src/webeval/oai_clients/messages.py:89
↓ 4 callers
Class
GracefulRetryClient
A multi-endpoint client that retries across endpoints on failure. Each ``create()`` round-robins over a pool of underlying :class:`ChatComple
webeval/src/webeval/oai_clients/graceful_client.py:34
↓ 4 callers
Class
MMRubricAgent
Multimodal rubric-based scoring agent (v3_mm). Produces two independent signals: - PROCESS REWARD (Steps 0-7): fine-grained rubric score
webeval/src/webeval/rubric_agent/mm_rubric_agent.py:892
↓ 4 callers
Class
MMRubricAgentConfig
Configuration for the multimodal rubric verification agent.
webeval/src/webeval/rubric_agent/mm_rubric_agent.py:785
↓ 4 callers
Class
Message
src/fara/qwen_helpers/schema.py:126
↓ 4 callers
Class
Trajectory
webeval/src/webeval/trajectory.py:121
↓ 4 callers
Class
WebTailBenchBenchmark
Held-out evaluation on WebTailBench, scored with MMRubricAgent.
webeval/src/webeval/benchmarks/webtailbench/webtailbench.py:59
↓ 3 callers
Class
CriticalPointClassificationResult
Task-only critical-point classification produced by the rubric agent. Stored on ``data_point.verification`` under the key ``"rubric_critical_
webeval/src/webeval/rubric_agent/data_point.py:547
↓ 3 callers
Class
EvalExp
webeval/scripts/eval_exp.py:157
↓ 3 callers
Class
ModelCapabilities
webeval/src/webeval/oai_clients/wrapper.py:87
↓ 3 callers
Class
ModelReference
webeval/scripts/eval_exp.py:81
↓ 3 callers
Class
VLLM
src/fara/vllm/vllm_facade.py:16
↓ 3 callers
Class
WebSurferSystem
WebSurferSystem that communicates with either a local or hosted WebSurfer model to perform web-based tasks. If websurfer_client_cfg i
webeval/src/webeval/systems/websurfer.py:19
↓ 2 callers
Class
AzVllm
src/fara/vllm/az_vllm.py:138
↓ 2 callers
Class
BrowserBB
Manages browser instance, context, and page lifecycle.
src/fara/browser/browser_bb.py:23
↓ 2 callers
Class
ComputerObservation
Observation from the environment: screenshot and/or page state.
webeval/src/webeval/rubric_agent/data_point.py:111
↓ 2 callers
Class
DataPoint
A single data generation run output.
webeval/src/webeval/rubric_agent/data_point.py:617
↓ 2 callers
Class
FaraAgent
src/fara/fara_agent.py:53
↓ 2 callers
Class
FinalAnswer
webeval/src/webeval/trajectory.py:11
↓ 2 callers
Class
MMRubricOutcomeResult
Binary outcome verification from the rubric pipeline.
webeval/src/webeval/rubric_agent/data_point.py:534
↓ 2 callers
Class
MMRubricResult
Result from the multimodal rubric verification pipeline.
webeval/src/webeval/rubric_agent/data_point.py:519
↓ 2 callers
Class
MajorityVoteMetadata
Metadata from majority voting in rubric scoring.
webeval/src/webeval/rubric_agent/data_point.py:508
↓ 2 callers
Class
NousFnCallPrompt
src/fara/qwen_helpers/fncall_prompt.py:12
↓ 2 callers
Class
ObservationsPre
Observations before an action.
webeval/src/webeval/rubric_agent/data_point.py:225
↓ 2 callers
Class
OpenAIClientWrapper
Wrapper around the OpenAI Python SDK (``openai.AsyncOpenAI``).
webeval/src/webeval/oai_clients/wrapper.py:253
↓ 2 callers
Class
Step
A single step: observations grouped around an action. Computed, never serialized.
webeval/src/webeval/rubric_agent/data_point.py:241
↓ 2 callers
Class
SystemMessage
webeval/src/webeval/oai_clients/messages.py:22
↓ 2 callers
Class
Task
Defines a task for the agent to solve.
webeval/src/webeval/rubric_agent/data_point.py:280
↓ 2 callers
Class
TaskAgentResult
Result from the unified task verification classification (Step 10). Classifies a task along two axes before execution: - Task Ambiguity (
webeval/src/webeval/rubric_agent/data_point.py:569
↓ 2 callers
Class
UserMessage
src/fara/fara_types.py:22
↓ 2 callers
Class
_AlwaysFailsClient
Fake ChatCompletionClient whose create() always raises ``exc``. Exposes the minimal surface GracefulRetryClient.create() touches: ``endpoint`
webeval/tests/test_oai_clients.py:136
↓ 2 callers
Class
_DummyClient
webeval/tests/test_rubric_agent_imports.py:92
↓ 2 callers
Class
_StubMMRubricAgent
Minimal stand-in for ``MMRubricAgent`` (Steps 0–8). Returns a fixed rubric + outcome verdict (with the new CP-classification fields populated
webeval/tests/test_verify_trajectories.py:129
↓ 2 callers
Class
_StubVerifierAgent
Stand-in for ``VerifierAgent`` — Steps 9a / 9b / 10. Mirrors the contract documented on ``VerifierAgent.verify`` — takes the rubric + outcome
webeval/tests/test_verify_trajectories.py:215
↓ 1 callers
Class
Action
The agent's decision and action.
webeval/src/webeval/rubric_agent/data_point.py:153
↓ 1 callers
Class
AssistantMessage
src/fara/fara_types.py:35
↓ 1 callers
Class
AzureMLClientWrapper
Wrapper for Azure ML managed-online endpoints with a custom ``/score`` API.
webeval/src/webeval/oai_clients/wrapper.py:449
↓ 1 callers
Class
AzureOpenAIClientWrapper
Wrapper around Azure OpenAI Chat Completions.
webeval/src/webeval/oai_clients/wrapper.py:296
↓ 1 callers
Class
AzureOpenAIResponsesWrapper
Wrapper around the Azure OpenAI Responses API (codex / o3-pro / gpt-5).
webeval/src/webeval/oai_clients/wrapper.py:358
↓ 1 callers
Class
Callback
webeval/scripts/webtailbench.py:27
↓ 1 callers
Class
Callback
webeval/scripts/eval_exp.py:127
↓ 1 callers
Class
Callback
webeval/scripts/om2w.py:15
↓ 1 callers
Class
Callback
webeval/scripts/webvoyager.py:16
↓ 1 callers
Class
CriticalPointType
Configuration for a single critical point type.
webeval/src/webeval/rubric_agent/_cp_schema.py:70
↓ 1 callers
Class
DataPointMetadata
Metadata about a data generation run.
webeval/src/webeval/rubric_agent/data_point.py:602
↓ 1 callers
Class
FaraComputerUse
src/fara/_prompts.py:19
↓ 1 callers
Class
FunctionCall
Represents a function call with arguments
src/fara/fara_types.py:71
↓ 1 callers
Class
LLMUsage
Token usage from an LLM call.
webeval/src/webeval/rubric_agent/data_point.py:53
↓ 1 callers
Class
LogHandler
File handler that serialises structured webeval events to JSONL.
webeval/src/webeval/utils.py:117
↓ 1 callers
Class
MlFlowRateLimiter
webeval/scripts/mlflow_rate_limiter.py:13
↓ 1 callers
Class
ModelResponse
Response from model call
src/fara/fara_types.py:63
↓ 1 callers
Class
OnlineM2WBenchmark
webeval/src/webeval/benchmarks/om2w/om2w.py:68
↓ 1 callers
Class
OpenaiEngine
webeval/src/webeval/benchmarks/om2w/impl/src/utils.py:64
↓ 1 callers
Class
Outcome
Result of solving a task.
webeval/src/webeval/rubric_agent/data_point.py:84
↓ 1 callers
Class
PlaywrightController
src/fara/browser/playwright_controller.py:249
↓ 1 callers
Class
ResponsesGracefulRetryClient
Variant that targets the Responses API (codex / gpt-5 family).
webeval/src/webeval/oai_clients/graceful_client.py:378
↓ 1 callers
Class
SolverLog
Solver output containing the sequence of observation-action steps.
webeval/src/webeval/rubric_agent/data_point.py:292
↓ 1 callers
Class
StepSummary
Per-step structured data extracted from SolverLog.steps.
webeval/src/webeval/rubric_agent/data_point.py:249
↓ 1 callers
Class
SystemMessage
src/fara/fara_types.py:15
↓ 1 callers
Class
VerifierAgent
Steps 9–10 of the multimodal rubric pipeline. Consumes the scored rubric + outcome verification produced by :class:`MMRubricAgent` and produc
webeval/src/webeval/rubric_agent/verifier_agent.py:148
↓ 1 callers
Class
VerifierAgentConfig
Configuration for :class:`VerifierAgent` (Steps 9a/9b/10).
webeval/src/webeval/rubric_agent/verifier_agent.py:119
↓ 1 callers
Class
WebSurferEvent
src/fara/fara_types.py:114
↓ 1 callers
Class
WebVoyagerBenchmark
Loads the WebVoyager dataset, stores it locally, and evaluates predictions using the GAIA evaluator.
webeval/src/webeval/benchmarks/webvoyager/webvoyager.py:48
↓ 1 callers
Class
_Lock
webeval/scripts/mlflow_rate_limiter.py:6
↓ 1 callers
Class
_ModelWrapper
webeval/src/webeval/benchmarks/om2w/om2w.py:56
↓ 1 callers
Class
_ParsedClassification
webeval/src/webeval/rubric_agent/critical_point_classifier.py:65
↓ 1 callers
Class
_StubAnswer
webeval/tests/test_webtailbench_dataset.py:161
↓ 1 callers
Class
_StubTraj
webeval/tests/test_webtailbench_dataset.py:165
Class
Agent
Trimmed Agent base — holds config, no run-context plumbing.
webeval/src/webeval/rubric_agent/base.py:29
Class
AgentConfig
Base configuration for agents.
webeval/src/webeval/rubric_agent/base.py:19
Class
AgentEvent
webeval/src/webeval/systems/messages.py:26
Class
AgentState
Snapshot of agent's internal state at decision time.
webeval/src/webeval/rubric_agent/data_point.py:144
Class
AssistantMessage
webeval/src/webeval/oai_clients/messages.py:32
Class
AzRef
webeval/scripts/analyze_eval_results/artifacts.py:13
Class
BaseModelCompatibleDict
src/fara/qwen_helpers/schema.py:26
Class
BaseSystem
All systems should implement this interface.
webeval/src/webeval/basesystem.py:11
Class
BaseTool
src/fara/qwen_helpers/base_tool.py:61
Class
Benchmark
Base benchmark class. Responsible for: - Downloading/loading data into data/<benchmark_name>/. - Storing examples in self.examples (e
webeval/src/webeval/benchmark.py:6
Class
ChatCompletionClient
Base interface for chat completion clients.
webeval/src/webeval/oai_clients/wrapper.py:133
Class
ClientWrapper
Namespace for the two ChatCompletionClient construction helpers. The wrappers in this module already carry the metadata callers historically
webeval/src/webeval/oai_clients/wrapper.py:560
Class
Component
Base class providing serialization/deserialization via pydantic.
webeval/src/webeval/rubric_agent/data_point.py:26
Class
Confidence
Judge confidence levels, with human-readable descriptions. Each member carries a short value (``"HIGH"``, etc.) and a longer ``description``
webeval/src/webeval/rubric_agent/_cp_schema.py:24
Class
CriticalPointAgent
Verifier agent that classifies a task's critical-point type. Two usage patterns: 1. **Via RunContext** (``run``): reads the task from the Da
webeval/src/webeval/rubric_agent/critical_point_classifier.py:295
Class
CriticalPointAgentConfig
Configuration for ``CriticalPointAgent``.
webeval/src/webeval/rubric_agent/critical_point_classifier.py:285
Class
CriticalPointTypesConfig
Loaded configuration for all critical point types. Typically deserialized from ``critical_point_types.yaml``.
webeval/src/webeval/rubric_agent/_cp_schema.py:80
Class
EvalLogs
webeval/scripts/analyze_eval_results/artifacts.py:67
Class
FunctionCall
webeval/src/webeval/oai_clients/messages.py:106
Class
FunctionCall
src/fara/qwen_helpers/schema.py:57
Class
ImageObj
Image wrapper for handling screenshots and images.
webeval/src/webeval/oai_clients/messages.py:37
Class
ImageObj
Image wrapper for handling screenshots and images
src/fara/fara_types.py:42
Class
ImageScore
Score for a single screenshot against task key points.
webeval/src/webeval/rubric_agent/data_point.py:492
Class
LLMCallEvent
Structured log event emitted by :class:`LogHandler` to record token usage.
webeval/src/webeval/utils.py:29
Class
LLMConversation
A sequence of LLM calls.
webeval/src/webeval/rubric_agent/data_point.py:70
Class
LLMMessage
webeval/src/webeval/oai_clients/messages.py:15
Class
LLMMessage
A single LLM call: request/response pair.
webeval/src/webeval/rubric_agent/data_point.py:61
next →
1–100 of 122, ranked by callers