POST to https://app.arize.com/graphql with an x-api-key header; see Forming calls.
Mutations in this page
createEvaluator: Create a new evaluatorcreateEvaluatorVersion: Create a new evaluator versioneditEvaluator: Edit an existing evaluatordeleteEvaluator: Delete an existing evaluatorcreateEvalTask: Create a new online eval taskpatchEvalTask: Patch eval task.patchEvalTaskWithEvalHub: Patch eval task with eval hub.migrateTaskToEvalHub: migrates a task’s evaluators to eval hubrunOnlineTask: Run an online taskcancelOnlineTaskRun: Cancel an online task rundeleteOnlineTask: Delete online task.runExperimentTask: Run an experiment task with configurable LLM interactionscreatePromptOptimizationTask: Create a new prompt optimization taskpatchPromptOptimizationTask: Patch prompt optimization task.
Reference
createEvaluator
Create a new evaluatorcreateEvaluator(input: CreateEvaluatorMutationInput!): CreateEvaluatorMutationPayload
Arguments
Show CreateEvaluatorMutationInput fields
Show CreateEvaluatorMutationInput fields
Show TemplateEvaluationConfigInput fields
Show TemplateEvaluationConfigInput fields
maximize, minimize, none.span, trace, session.Show TemplateEvaluationLlmConfigInput fields
Show TemplateEvaluationLlmConfigInput fields
Show CodeEvaluationConfigInput fields
Show CodeEvaluationConfigInput fields
span, trace, session.Show HarnessEvaluatorInput fields
Show HarnessEvaluatorInput fields
maximize, minimize, none.Show RemoteEvaluatorInput fields
Show RemoteEvaluatorInput fields
span, trace, session.Show SystemOneEvaluatorInput fields
Show SystemOneEvaluatorInput fields
jev-latest. Required: the column has no default, so which route was asked for is always recorded.Show SystemOneQuestionInput fields
Show SystemOneQuestionInput fields
boolean, choice, score.none for every other type. One of: minimize, maximize, none.span, trace, session.Returns
Show Evaluator fields
Show Evaluator fields
id, name, description, taskType, commitHash, commitMessage, createdAt, updatedAt.Object fields (select subfields): versionHistory, webhookSubscriptions, config, harnessEvaluationConfig, remoteEvaluationConfig, systemOneEvaluationConfig, createdBy, tags, onlineTasks.Example
Only required input fields are shown. Replace<ID> and <string> placeholders with real values; the object graph page shows how to look IDs up.
mutation CreateEvaluator($input: CreateEvaluatorMutationInput!) {
createEvaluator(input: $input) {
evaluator { id name }
}
}
{
"input": {
"spaceId": "<ID>",
"name": "<string>",
"commitMessage": "<string>"
}
}
createEvaluatorVersion
Create a new evaluator versioncreateEvaluatorVersion(input: CreateEvaluatorVersionMutationInput!): CreateEvaluatorVersionMutationPayload
Arguments
Show CreateEvaluatorVersionMutationInput fields
Show CreateEvaluatorVersionMutationInput fields
Show TemplateEvaluationConfigInput fields
Show TemplateEvaluationConfigInput fields
maximize, minimize, none.span, trace, session.Show TemplateEvaluationLlmConfigInput fields
Show TemplateEvaluationLlmConfigInput fields
Show CodeEvaluationConfigInput fields
Show CodeEvaluationConfigInput fields
span, trace, session.Show HarnessEvaluatorVersionInput fields
Show HarnessEvaluatorVersionInput fields
maximize, minimize, none.Show SystemOneEvaluatorVersionInput fields
Show SystemOneEvaluatorVersionInput fields
jev-latest. Required: the column has no default, so which route was asked for is always recorded.Show SystemOneQuestionInput fields
Show SystemOneQuestionInput fields
boolean, choice, score.none for every other type. One of: minimize, maximize, none.Returns
Show Evaluator fields
Show Evaluator fields
id, name, description, taskType, commitHash, commitMessage, createdAt, updatedAt.Object fields (select subfields): versionHistory, webhookSubscriptions, config, harnessEvaluationConfig, remoteEvaluationConfig, systemOneEvaluationConfig, createdBy, tags, onlineTasks.Show EvaluatorVersion fields
Show EvaluatorVersion fields
id, evaluatorId, commitHash, commitMessage, createdAt, updatedAt, versionNumber.Object fields (select subfields): evaluator, harnessEvaluationConfig, remoteEvaluationConfig, systemOneEvaluationConfig, createdBy.Example
Only required input fields are shown. Replace<ID> and <string> placeholders with real values; the object graph page shows how to look IDs up.
mutation CreateEvaluatorVersion($input: CreateEvaluatorVersionMutationInput!) {
createEvaluatorVersion(input: $input) {
evaluator { id name }
evaluatorVersion { id }
}
}
{
"input": {
"evaluatorId": "<ID>",
"commitMessage": "<string>"
}
}
editEvaluator
Edit an existing evaluatoreditEvaluator(input: EditEvaluatorMutationInput!): EditEvaluatorMutationPayload
Arguments
Returns
Show Evaluator fields
Show Evaluator fields
id, name, description, taskType, commitHash, commitMessage, createdAt, updatedAt.Object fields (select subfields): versionHistory, webhookSubscriptions, config, harnessEvaluationConfig, remoteEvaluationConfig, systemOneEvaluationConfig, createdBy, tags, onlineTasks.Example
Only required input fields are shown. Replace<ID> and <string> placeholders with real values; the object graph page shows how to look IDs up.
mutation EditEvaluator($input: EditEvaluatorMutationInput!) {
editEvaluator(input: $input) {
evaluator { id name }
}
}
{
"input": {
"evaluatorId": "<ID>"
}
}
deleteEvaluator
Delete an existing evaluatordeleteEvaluator(input: DeleteEvaluatorMutationInput!): DeleteEvaluatorMutationPayload
Arguments
Returns
Example
Only required input fields are shown. Replace<ID> and <string> placeholders with real values; the object graph page shows how to look IDs up.
mutation DeleteEvaluator($input: DeleteEvaluatorMutationInput!) {
deleteEvaluator(input: $input) {
success
}
}
{
"input": {
"evaluatorId": "<ID>"
}
}
createEvalTask
Create a new online eval taskcreateEvalTask(input: CreateEvalTaskMutationInput!): CreateEvalTaskMutationPayload
Arguments
Show CreateEvalTaskMutationInput fields
Show CreateEvalTaskMutationInput fields
Show FilterItemInputType fields
Show FilterItemInputType fields
featureLabel, tagLabel, predictionValue, actuals, modelVersion, batchId, predictionClass, predictionScore, actualClass, actualScore, topKPercentile, spanProperty, llmEval, annotation, userAnnotation.greaterThan, lessThan, equals, notEquals, greaterThanOrEqual, lessThanOrEqual, topN, contains, containsString, similarTo.Show DimensionInput fields
Show DimensionInput fields
STRING, LONG, FLOAT, DOUBLE, EMBEDDING, STRING_LIST, DICTIONARY.featureLabel, prediction, actuals, actualScore, actualClass, predictionClass, predictionScore, tag, spanProperty, llmEval, annotation, userAnnotation, modelVersion, batchId.Show OnlineTaskLLMConfigInput fields
Show OnlineTaskLLMConfigInput fields
openAI, anthropic, awsBedrock, azureOpenAI, vertexAI, custom, nvidiaNim, gemini, litellm, fireworks, togetherAi, cursor, typeSafeAi.Show TemplateEvaluationConfigInput fields
Show TemplateEvaluationConfigInput fields
maximize, minimize, none.span, trace, session.Show TemplateEvaluationLlmConfigInput fields
Show TemplateEvaluationLlmConfigInput fields
Show CodeEvaluationConfigInput fields
Show CodeEvaluationConfigInput fields
span, trace, session.Show OnlineTaskPostProcessingStepInput fields
Show OnlineTaskPostProcessingStepInput fields
Show OnlineTaskEvaluatorInput fields
Show OnlineTaskEvaluatorInput fields
Show SubqueryColumnMappingInput fields
Show SubqueryColumnMappingInput fields
Returns
Show OnlineTask fields
Show OnlineTask fields
id, taskType, name, samplingRate, lastRunAt, queryFilter, createdAt, updatedAt, deletedAt, runContinuously, tracingEnabled, experimentIds, hasUnavailableEvaluatorIntegration.Object fields (select subfields): model, multiSpanQuery, createdBy, llmConfig, taskConfig, evaluators, onlineTaskEvaluators, allEvaluatorConfigs, taskRuns, experiments, dataset, postProcessingSteps.Example
Only required input fields are shown. Replace<ID> and <string> placeholders with real values; the object graph page shows how to look IDs up.
mutation CreateEvalTask($input: CreateEvalTaskMutationInput!) {
createEvalTask(input: $input) {
evalTask { id name }
}
}
{
"input": {
"name": "<string>",
"samplingRate": 1,
"runContinuously": true
}
}
patchEvalTask
patchEvalTask(input: PatchEvalTaskMutationInput!): PatchEvalTaskMutationPayload
Arguments
Show PatchEvalTaskMutationInput fields
Show PatchEvalTaskMutationInput fields
Show FilterItemInputType fields
Show FilterItemInputType fields
featureLabel, tagLabel, predictionValue, actuals, modelVersion, batchId, predictionClass, predictionScore, actualClass, actualScore, topKPercentile, spanProperty, llmEval, annotation, userAnnotation.greaterThan, lessThan, equals, notEquals, greaterThanOrEqual, lessThanOrEqual, topN, contains, containsString, similarTo.Show DimensionInput fields
Show DimensionInput fields
STRING, LONG, FLOAT, DOUBLE, EMBEDDING, STRING_LIST, DICTIONARY.featureLabel, prediction, actuals, actualScore, actualClass, predictionClass, predictionScore, tag, spanProperty, llmEval, annotation, userAnnotation, modelVersion, batchId.Show OnlineTaskLLMConfigInput fields
Show OnlineTaskLLMConfigInput fields
openAI, anthropic, awsBedrock, azureOpenAI, vertexAI, custom, nvidiaNim, gemini, litellm, fireworks, togetherAi, cursor, typeSafeAi.Show TemplateEvaluationConfigInput fields
Show TemplateEvaluationConfigInput fields
maximize, minimize, none.span, trace, session.Show TemplateEvaluationLlmConfigInput fields
Show TemplateEvaluationLlmConfigInput fields
Show CodeEvaluationConfigInput fields
Show CodeEvaluationConfigInput fields
span, trace, session.Show OnlineTaskPostProcessingStepInput fields
Show OnlineTaskPostProcessingStepInput fields
Show OnlineTaskEvaluatorInput fields
Show OnlineTaskEvaluatorInput fields
Show SubqueryColumnMappingInput fields
Show SubqueryColumnMappingInput fields
Returns
Show OnlineTask fields
Show OnlineTask fields
id, taskType, name, samplingRate, lastRunAt, queryFilter, createdAt, updatedAt, deletedAt, runContinuously, tracingEnabled, experimentIds, hasUnavailableEvaluatorIntegration.Object fields (select subfields): model, multiSpanQuery, createdBy, llmConfig, taskConfig, evaluators, onlineTaskEvaluators, allEvaluatorConfigs, taskRuns, experiments, dataset, postProcessingSteps.Example
Only required input fields are shown. Replace<ID> and <string> placeholders with real values; the object graph page shows how to look IDs up.
mutation PatchEvalTask($input: PatchEvalTaskMutationInput!) {
patchEvalTask(input: $input) {
evalTask { id name }
}
}
{
"input": {
"onlineTaskId": "<ID>"
}
}
patchEvalTaskWithEvalHub
patchEvalTaskWithEvalHub(input: PatchEvalTaskWithEvalHubMutationInput!): PatchEvalTaskWithEvalHubMutationPayload
Arguments
Show PatchEvalTaskWithEvalHubMutationInput fields
Show PatchEvalTaskWithEvalHubMutationInput fields
Show FilterItemInputType fields
Show FilterItemInputType fields
featureLabel, tagLabel, predictionValue, actuals, modelVersion, batchId, predictionClass, predictionScore, actualClass, actualScore, topKPercentile, spanProperty, llmEval, annotation, userAnnotation.greaterThan, lessThan, equals, notEquals, greaterThanOrEqual, lessThanOrEqual, topN, contains, containsString, similarTo.Show DimensionInput fields
Show DimensionInput fields
STRING, LONG, FLOAT, DOUBLE, EMBEDDING, STRING_LIST, DICTIONARY.featureLabel, prediction, actuals, actualScore, actualClass, predictionClass, predictionScore, tag, spanProperty, llmEval, annotation, userAnnotation, modelVersion, batchId.Show OnlineTaskLLMConfigInput fields
Show OnlineTaskLLMConfigInput fields
openAI, anthropic, awsBedrock, azureOpenAI, vertexAI, custom, nvidiaNim, gemini, litellm, fireworks, togetherAi, cursor, typeSafeAi.Show OnlineTaskEvaluatorInput fields
Show OnlineTaskEvaluatorInput fields
Show SubqueryColumnMappingInput fields
Show SubqueryColumnMappingInput fields
Show OnlineTaskPostProcessingStepInput fields
Show OnlineTaskPostProcessingStepInput fields
Returns
Show OnlineTask fields
Show OnlineTask fields
id, taskType, name, samplingRate, lastRunAt, queryFilter, createdAt, updatedAt, deletedAt, runContinuously, tracingEnabled, experimentIds, hasUnavailableEvaluatorIntegration.Object fields (select subfields): model, multiSpanQuery, createdBy, llmConfig, taskConfig, evaluators, onlineTaskEvaluators, allEvaluatorConfigs, taskRuns, experiments, dataset, postProcessingSteps.Example
Only required input fields are shown. Replace<ID> and <string> placeholders with real values; the object graph page shows how to look IDs up.
mutation PatchEvalTaskWithEvalHub($input: PatchEvalTaskWithEvalHubMutationInput!) {
patchEvalTaskWithEvalHub(input: $input) {
evalTask { id name }
}
}
{
"input": {
"onlineTaskId": "<ID>"
}
}
migrateTaskToEvalHub
migrates a task’s evaluators to eval hubmigrateTaskToEvalHub(input: MigrateTaskToEvalHubMutationInput!): MigrateTaskToEvalHubMutationPayload
Arguments
Returns
Show OnlineTask fields
Show OnlineTask fields
id, taskType, name, samplingRate, lastRunAt, queryFilter, createdAt, updatedAt, deletedAt, runContinuously, tracingEnabled, experimentIds, hasUnavailableEvaluatorIntegration.Object fields (select subfields): model, multiSpanQuery, createdBy, llmConfig, taskConfig, evaluators, onlineTaskEvaluators, allEvaluatorConfigs, taskRuns, experiments, dataset, postProcessingSteps.Example
Only required input fields are shown. Replace<ID> and <string> placeholders with real values; the object graph page shows how to look IDs up.
mutation MigrateTaskToEvalHub($input: MigrateTaskToEvalHubMutationInput!) {
migrateTaskToEvalHub(input: $input) {
onlineTask { id name }
}
}
{
"input": {
"onlineTaskId": "<ID>"
}
}
runOnlineTask
Run an online taskrunOnlineTask(input: RunOnlineTaskMutationInput!): RunOnlineTaskMutationPayload
Arguments
Show RunOnlineTaskMutationInput fields
Show RunOnlineTaskMutationInput fields
Returns
TaskError, CreateTaskRunResponse. Use inline fragments (... on TypeName).Example
Only required input fields are shown. Replace<ID> and <string> placeholders with real values; the object graph page shows how to look IDs up.
mutation RunOnlineTask($input: RunOnlineTaskMutationInput!) {
runOnlineTask(input: $input) {
result { __typename }
}
}
{
"input": {}
}
cancelOnlineTaskRun
Cancel an online task runcancelOnlineTaskRun(input: CancelOnlineTaskRunMutationInput!): CancelOnlineTaskRunMutationPayload
Arguments
Returns
TaskError, CancelTaskRunResponse. Use inline fragments (... on TypeName).Example
Only required input fields are shown. Replace<ID> and <string> placeholders with real values; the object graph page shows how to look IDs up.
mutation CancelOnlineTaskRun($input: CancelOnlineTaskRunMutationInput!) {
cancelOnlineTaskRun(input: $input) {
result { __typename }
}
}
{
"input": {
"onlineTaskRunId": "<ID>"
}
}
deleteOnlineTask
deleteOnlineTask(input: DeleteOnlineTaskMutationInput!): DeleteOnlineTaskMutationPayload
Arguments
Returns
Show DeleteOnlineTaskFailure fields
Show DeleteOnlineTaskFailure fields
taskId, message.Example
Only required input fields are shown. Replace<ID> and <string> placeholders with real values; the object graph page shows how to look IDs up.
mutation DeleteOnlineTask($input: DeleteOnlineTaskMutationInput!) {
deleteOnlineTask(input: $input) {
success
deletedTaskIds
failedTasks { message }
}
}
{
"input": {
"onlineTaskIds": [
"<ID>"
]
}
}
runExperimentTask
Run an experiment task with configurable LLM interactionsrunExperimentTask(input: RunExperimentTaskMutationInput!): RunExperimentTaskMutationPayload
Arguments
Show RunExperimentTaskMutationInput fields
Show RunExperimentTaskMutationInput fields
Show RunExperimentConfigInput fields
Show RunExperimentConfigInput fields
llm_generation, template_evaluation, code_evaluation, agent_call.Show LLMInput fields
Show LLMInput fields
openAI, azureOpenAI, anthropic, vertexAI, awsBedrock, custom, nvidiaNim, gemini, litellm, fireworks, togetherAi.LLMMessageInput (same shape as above).InvocationParamsInput (same shape as above).ProviderParamsInput (same shape as above).F_STRING, MUSTACHE, NONE.Show TemplateEvalConfigInput fields
Show TemplateEvalConfigInput fields
Show CodeEvalConfigInput fields
Show CodeEvalConfigInput fields
CustomCodeEvalInfoInput (same shape as above).Returns
RunExperimentTaskSuccess, RunExperimentTaskError. Use inline fragments (... on TypeName).Example
Only required input fields are shown. Replace<ID> and <string> placeholders with real values; the object graph page shows how to look IDs up.
mutation RunExperimentTask($input: RunExperimentTaskMutationInput!) {
runExperimentTask(input: $input) {
result { __typename }
}
}
{
"input": {
"datasetId": "<ID>",
"datasetName": "<string>",
"datasetVersionId": "<ID>",
"spaceId": "<ID>",
"exampleOverrides": [
{
"exampleId": "<string>",
"overridesJSON": {}
}
],
"runConfigurations": [
{
"experimentType": "llm_generation",
"experimentName": "<string>",
"instanceId": 1
}
]
}
}
createPromptOptimizationTask
Create a new prompt optimization taskcreatePromptOptimizationTask(input: CreatePromptOptimizationTaskMutationInput!): CreatePromptOptimizationTaskMutationPayload
Arguments
Show CreatePromptOptimizationTaskMutationInput fields
Show CreatePromptOptimizationTaskMutationInput fields
Show OnlineTaskLLMConfigInput fields
Show OnlineTaskLLMConfigInput fields
openAI, anthropic, awsBedrock, azureOpenAI, vertexAI, custom, nvidiaNim, gemini, litellm, fireworks, togetherAi, cursor, typeSafeAi.Returns
Show OnlineTask fields
Show OnlineTask fields
id, taskType, name, samplingRate, lastRunAt, queryFilter, createdAt, updatedAt, deletedAt, runContinuously, tracingEnabled, experimentIds, hasUnavailableEvaluatorIntegration.Object fields (select subfields): model, multiSpanQuery, createdBy, llmConfig, taskConfig, evaluators, onlineTaskEvaluators, allEvaluatorConfigs, taskRuns, experiments, dataset, postProcessingSteps.Example
Only required input fields are shown. Replace<ID> and <string> placeholders with real values; the object graph page shows how to look IDs up.
mutation CreatePromptOptimizationTask($input: CreatePromptOptimizationTaskMutationInput!) {
createPromptOptimizationTask(input: $input) {
promptOptimizationTask { id name }
}
}
{
"input": {
"datasetId": "<ID>",
"name": "<string>",
"runContinuously": true,
"llmConfig": {
"integrationId": "<ID>",
"modelName": "<string>",
"invocationParameters": "<JSONObject>",
"providerParameters": "<JSONObject>"
},
"promptOptimizationConfig": {
"userInstructions": "<string>",
"outputColumn": "<string>",
"feedbackColumns": [
"<string>"
],
"batchSize": 1,
"promptId": "<ID>"
}
}
}
patchPromptOptimizationTask
patchPromptOptimizationTask(input: PatchPromptOptimizationTaskMutationInput!): PatchPromptOptimizationTaskMutationPayload
Arguments
Show PatchPromptOptimizationTaskMutationInput fields
Show PatchPromptOptimizationTaskMutationInput fields
Show OnlineTaskLLMConfigInput fields
Show OnlineTaskLLMConfigInput fields
openAI, anthropic, awsBedrock, azureOpenAI, vertexAI, custom, nvidiaNim, gemini, litellm, fireworks, togetherAi, cursor, typeSafeAi.Returns
Show OnlineTask fields
Show OnlineTask fields
id, taskType, name, samplingRate, lastRunAt, queryFilter, createdAt, updatedAt, deletedAt, runContinuously, tracingEnabled, experimentIds, hasUnavailableEvaluatorIntegration.Object fields (select subfields): model, multiSpanQuery, createdBy, llmConfig, taskConfig, evaluators, onlineTaskEvaluators, allEvaluatorConfigs, taskRuns, experiments, dataset, postProcessingSteps.Example
Only required input fields are shown. Replace<ID> and <string> placeholders with real values; the object graph page shows how to look IDs up.
mutation PatchPromptOptimizationTask($input: PatchPromptOptimizationTaskMutationInput!) {
patchPromptOptimizationTask(input: $input) {
promptOptimizationTask { id name }
}
}
{
"input": {
"onlineTaskId": "<ID>"
}
}