G8 - the complete GenAIOps lifecycle

assistant:v12
│
├── foundation model deployment
├── system prompt:v8
├── prompt template:v5
├── chunking config:v4
├── embedding model:v3
├── search config:v7
├── index/corpus:v21
├── top-k = 5
├── reranker:v2
└── tool definitions:v6
candidate configuration
        ↓
evaluation dataset
        ↓
compare with current version
RETRIEVAL
Recall@k
Precision@k
MRR

GENERATION
Groundedness
Relevance

AGENT
Tool selection
Arguments
Task completion

OPERATIONS
Latency
Tokens
Cost
user question
      ↓
entire application
      ↓
final response/task
      ↓
end-to-end quality
candidate application config
        ↓
staging
        ↓
evaluation/integration tests
        ↓
approval
        ↓
production
PRODUCTION
   │
   ├── latency/errors
   ├── tokens/cost
   ├── retrieval health
   ├── tool health
   ├── quality signals
   ├── safety signals
   └── user feedback
new documents
      ↓
ingestion
      ↓
chunk
      ↓
embed
      ↓
index update
      ↓
production knowledge changes