Skip to content
FlowHubFluxonLab
AI Agents & Chatbotsfree

Evaluation metric example: Correctness (judged by AI)

by David RobertsUpdated Aug 2026
RequiresOpenAI
Share Post Share
OpenAI Chat ModelOpenAI Chat Mod…EvWhen fetching a dataset rowWhen fetching a…EvEvaluating?AgAI AgentCalculate correctness metricCalculate corre…ChWhen chat message receivedWhen chat messa…SeMatch chat formatMatch chat form…NOReturn chat responseReturn chat res…EvSet metrics12345678
1/5
STEPS · 8
Starts on a Evaluation event

On chat or evaluation input, runs an AI agent and scores answer correctness using OpenAI as the judge.

Tags

eventmediumOpenAIEngineeringAI Summarizationdiscoveredpending-review
Connects
OpenAI
CategoryAI Agents & Chatbots
Triggerevent
Complexitymedium
Nodes9
AddedJun 27, 2026