Blog
AI 기술 블로그, API 튜토리얼, 업계 소식
태그: 코딩에이전트지우기

단순 성공 여부(Pass/Fail)를 넘어: 코딩 에이전트 평가를 위한 새로운 기준 'AgentLens'
단순한 결과 검증을 넘어 AI 코딩 에이전트의 전체 작업 과정(Trajectory)을 다각도로 평가하는 새로운 오픈소스 벤치마크, AgentLens를 소개합니다.

스스로 진화하는 AI와 검증의 난제: AlgoEvolve와 검증의 지평선(The Verification Horizon)을 통해 본 AI 코딩의 미래
대형 언어 모델(LLM)이 코드를 직접 진화시키고 개선하는 시대가 열렸습니다. 트레이딩 전략을 스스로 학습하는 'AlgoEvolve'와 코딩 에이전트의 검증 문제를 다룬 최신 연구들을 통해 AI 코드 생성 기술의 현주소와 향후 과제를 분석합니다.