Agustin Diaz Lusarreta
Agustin Diaz Lusarreta

LLM Evaluation Specialist

Actively looking · Member since 25 Sep 2026
Location
Argentina
Desired salary
Unspecified
Work preference
Remote Only
Experience level
Mid

About

Professional summary

I am an LLM and AI Agent Evaluation Specialist with an Agricultural Engineering background, focused on evaluating conversational AI systems and large language model outputs in technical and scientific contexts.

I have evaluated more than 1,000 model outputs across multi-phase AI programs, including response ranking, grammar and spelling assessment, multilingual search-quality evaluation, and comparative testing across multiple models.

I design adversarial prompts, guided instructions, and evaluation rubrics that expose distinct model failure modes. My work includes hallucination detection, instruction-following assessment, reasoning-quality analysis, and model self-correction evaluation.

I also have experience evaluating AI-generated speech and transcription quality for naturalness, intelligibility, pronunciation, transcript alignment, and standardized quality criteria.

My quality assurance background in agricultural processing has strengthened my ability to conduct structured testing, root-cause analysis, anomaly detection, documentation, and corrective-action support.

I work professionally in Spanish and English, and I use working knowledge of SQL, JavaScript, HTML, Node.js, and Postman to support code-reasoning and API-related evaluation tasks.

Skills

9 capabilities

Tech stack & tools

Working toolkit

Application Utilities

Languages & Frameworks

Experience

Career history

AI/LLM Evaluation Analyst Welocalize / Welo Data

I have evaluated more than 1,000 outputs for a confidential frontier AI lab program across increasingly complex evaluation phases. My work began with selecting best responses and identifying grammar and spelling issues in real user-model conversations.

I conduct multilingual search evaluation by authoring themed prompts, testing them across four models, and scoring source reliability, localization, and time correctness. I also design flawed-response prompts, step-by-step guided instructions, and rubrics for self-correction testing, while evaluating AI speech for naturalness, intelligibility, pronunciation, transcript alignment, and linguistic quality in Spanish and English.

AI Transcription & Quality Evaluator CrowdGen

I transcribed and quality-checked AI-generated audio and speech content against defined accuracy and standardization criteria.

I identified transcription errors and content-quality issues and delivered structured feedback to improve output consistency and quality.

QA Technician McCain Foods

I performed quality-control testing, sampling, and structured data analysis against standardized specifications in an industrial agricultural-processing environment.

I investigated quality deviations, documented findings, and supported corrective actions through root-cause analysis. This experience developed rigorous QA, error-detection, and assessment practices transferable to AI evaluation.

Education

Learning history

Argentina

Agricultural Engineer, Agricultural Engineering

Completed Agricultural Engineering degree. Developed scientific and analytical training in structured problem-solving, technical assessment, and agricultural-domain evaluation.

This professional hasn’t added portfolio projects yet.

This professional hasn’t listed any services yet.

Jobs Talent AI Tools Salaries
Menu