AI-Wiki
Search
Search
Dark mode
Light mode
Explorer
Tag: agent-development-lifecycle
8 items with this tag.
Sep 01, 2026
agent-development-lifecycle
agent-development-lifecycle
adlc
ai-agents
agent-engineering
lifecycle-frameworks
sdlc-parallel
build-test-deploy-monitor
agent-governance
evals
llm-as-judge
type/concept
Aug 12, 2026
Evals 101 — Doug Guthrie, Braintrust
evals
ai-evaluation
llm-as-judge
observability
agent-development-lifecycle
agent-harness
braintrust
ai-engineer-worlds-fair
flywheel-effect
human-in-the-loop
online-scoring
offline-evals
type/source
kind/video
Aug 12, 2026
AI Evaluations Clearly Explained in 50 Minutes (Real Example) — Hamel Husain on Peter Yang's podcast
evals
ai-evaluation
llm-as-judge
observability
binary-pass-fail
agreement-metric
true-positive-rate
true-negative-rate
error-analysis
axial-coding
spreadsheet-evals
hamel-husain
peter-yang
agent-development-lifecycle
agent-harness
ai-product-management
type/source
kind/video
Aug 12, 2026
Agentic Evaluations Workshop — Deep Dive on the Future of Evals for Agents
evals
agentic-evals
ai-benchmarks
reliability
capability-reliability-gap
automation-vs-augmentation
gaia-2
are-environment
inspect-ai
lighteval
open-llm-leaderboard
community-eval
living-benchmarks
every-eval-ever
sim-to-real-gap
reward-hacking
llm-as-judge
rubrics
agent-development-lifecycle
agent-harness
ai-policy
hugging-face
type/source
kind/video
Aug 12, 2026
Harrison Chase
harrison-chase
langchain
langgraph
langsmith
langchain-labs
deep-agents
agent-development-lifecycle
continual-learning
agentic-engineering
ceo-founder
type/entity
kind/person
Aug 12, 2026
The Agent Development Lifecycle
langchain
agent-development-lifecycle
adlc
build-test-deploy-monitor
governance
langgraph
langsmith
deep-agents
agent-runtime
agent-harness
evaluation
tracing
simulation
sandboxes
prompt-hub
type/source
kind/article
May 25, 2026
Evals for taste: Hill-climbing a slide-generation agent
anthropic
claude-channel
ai-dev-26
evals
evals-for-taste
hill-climbing
slide-generation-agent
code-based-graders
model-based-graders
human-graders
llm-as-judge
pairwise-comparison
multi-judge-consensus
judge-calibration
qa-loop-adversarial
opus-4-7
sonnet-4-7
manage-agent
python-pptx
eval-saturation
autoregressive-judge-ordering-bug
agent-development-lifecycle
vendor-altitude-evals-doctrine
type/source
kind/video
May 08, 2026
Agents CLI in Agent Platform: create to production in one CLI
ai-agents
google
google-cloud
agent-platform
agents-cli
adk
agent-development-lifecycle
harness
harness-frameworks
coding-agents
gemini-enterprise
cloud-run
gke
agent-runtime
mcp
a2a
build-agents-with-agents
type/source
kind/article