LLM 평가 글 목록
코텍시스 기술 블로그에서 LLM 평가 태그가 붙은 글 3편을 모았습니다. 기업 AI 도입과 AX 현장에서 확인한 내용을 정리합니다.
글 3편
개발
Airlock 제출: 시연 영상과 공개 데모와 에이전트 모드 최종 측정
Nebius × NVIDIA Global AI Hackathon에 Airlock을 제출했습니다. 3분 시연 영상과 공개 데모 주소, 그리고 GLiNER 앙상블을 켜고 다시 측정한 에이전트 모드 결과(연결 가능한 노출 81.2%에서 8.3%)를 세 번의 실행과 함께 정리했습니다.
Cortexys2026.10.03
개발
Airlock 연결 가능한 노출을 13.9%에서 7.5%로 줄인 과정
Airlock의 연결 가능한 노출이 13.9%에서 7.5%로 내려간 과정을 정리했습니다. GLiNER 앙상블과 준식별자 조합 일반화와 정규화 텍스트 탐지를 어떤 변형끼리 비교해 골랐는지 표로 담았습니다.
Cortexys2026.09.15
개발
AI 에이전트 이그레스 방화벽 Airlock의 첫 측정 결과
AI 에이전트용 이그레스 방화벽 Airlock을 한국어와 영어 합성 케이스 243건으로 3회 독립 측정했습니다. 연결 가능한 노출은 84.7%에서 13.9%로 줄었고 측정 과정에서 저지른 실수도 함께 정리했습니다.
Cortexys2026.09.14

