맞춤형 사이버보안 데이터셋
모델의 사이버보안 능력을 향상시키기 위한 고난도의 테스크를 개발합니다. 테스크에서 모델이 실제로 어려움을 느끼는지, 인위적으로 난이도를 높였는지 여부를 직접 검토합니다.
CYVARC는 사이버보안의 최고 전문가로 구성된 팀입니다. 우리는 AI의 사이버보안 능력을 향상시키기 위한 고난도의 테스크를 제작하고 검증합니다.
신뢰성모든 태스크를 수동으로 직접 검토합니다.
고품질독창적이고 전문가가 풀 수 있는 공정한 테스크입니다.
맞춤형고객이 원하는 목표, 형식에 부합하는 테스크를 제작합니다.
모델의 사이버보안 능력을 향상시키기 위한 고난도의 테스크를 개발합니다. 테스크에서 모델이 실제로 어려움을 느끼는지, 인위적으로 난이도를 높였는지 여부를 직접 검토합니다.
모든 기업은 원하는 목표와 비전이 다릅니다. AI 기반 제품은 많아지지만, 어떤 제품을 쓰는게 좋을지 대한 맞춤형 평가지가 없습니다. 기업이 원하는 목표와 비전에 맞춘 특화 벤치마크를 개발하여, 어떤 AI 제품이 가장 부합하는지 정량적으로 평가하는 평가지를 만듭니다.
서비스 취약점 점검 업무를 자동화하세요. 파급력 높은 취약점을 찾는 것보다, 중요한 행동은 사람이 빠르게 통제 및 개입할 수 있어야 합니다.
공정한 보상을 위한 평가기준 설정
전문가의 추론 과정 상세화
공정한 성능 평가를 위한 테스트셋
데이터는 모델을 가르칠 수 있는 유일한 방법 중 하나입니다. 나쁜 데이터로 학습한 모델은, 좋은 데이터로 학습한 모델에 비해 성능과 능력이 매우 떨어집니다. 휼륭한 교사가 학생을 지도하면 훌륭한 인재가 배출되는 것처럼, 좋은 데이터가 모델의 성능과 능력을 극대화시킵니다.
잘못된 이유로 모델을 실패하게 만드는 불공정한 인위적인 태스크
태스크 자체가 공정한 풀이를 가로막습니다.
명시되지 않은 불합리한 가정을 알아내야 테스크를 해결할 수 있습니다.
타당한 이유로 모델이 어려움을 느끼는 공정한 태스크
에이전트는 실패할 수 있습니다. 전문가는 해결할 수 있습니다.
전문가는 주어진 근거를 조합하여 추론하고, 이를 통해 풀이를 도출할 수 있습니다.
프론티어 모델도 충분한 어려움을 겪습니다.
추측이 아니라 추론을 통해 해결해야합니다.
숙련된 전문가는 직접 해결할 수 있습니다.
콘텐츠가 많아지면 노이즈도 많아집니다. 인터넷과 현재 납품되는 사이버보안 데이터셋에는 오류, 중복, 인위적인 난이도가 섞여 있습니다.
좋은 데이터는 쉽게 흉내 낼 수 있습니다.
이를 선별하고 좋은 데이터셋을 만들기 위해서는 전문성이 필요합니다.
CTF와 실무 전문성만으로는, 학습에 바로 쓸 수 있는 데이터가 만들어지지 않습니다. 하지만 CYVARC이 생성 기준과 검토를 책임지므로, 고객이 품질에 추가로 신경쓸 필요가 없습니다.
CYVARC에 소속된 전문가들이 모든 태스크를 직접 제작하고 테스트하며 검토합니다. 이 과정을 통과한 소수의 태스크만, 고객에게 제공되는 데이터셋에 포함됩니다.
선별된 전문가가 태스크와 환경을 만들고, 성공한 접근법과 실패한 접근법을 모두 기록합니다.
두 번째 전문가가 풀이를 보지 않고 해결하며, Tragency로 에이전트 궤적을 살펴보고 보상 로직을 검증합니다.
승인된 태스크만 환경, 풀이, 채점기, 검증 근거와 함께 고객의 데이터셋에 포함됩니다.
독창적인 고난도 테스크, 검증된 풀이, 실패한 접근법까지 포함한 구조화된 추론을 제공합니다.
에이전트가 완료했다고 주장하는 내용이 아니라 풀이 실제 상태를 확인하는 채점기를 설계하고 제공합니다.
모든 태스크를 우리 팀이 직접 검토합니다. 표본 검사로 대신하지 않습니다.
에이전트가 의도한 풀이를 보지 않은 상태에서 태스크를 다시 풉니다.
보상 해킹과 편법을 적극적으로 찾아냅니다.
고객이 배치를 승인할 때까지 계속 수정합니다.
컨텍스트를 과도하게 채우지 않습니다. 추측에 의존하는 답을 요구하지 않습니다.
기존 CTF 챌린지나 풀이 문서를 재활용하지 않습니다.
하나의 아이디어로 하나의 태스크를 만듭니다. 아이디어 수준에서 중복을 제거합니다.
버전이 고정된 컨테이너 환경에서 실행할 수 있습니다.
현재 프런티어 모델의 통과율을 기준으로 난이도를 보정합니다.
풀이 문서와 의도한 풀이, 태스크가 어려운 이유를 제공합니다.
CYVARC은 여러 오펜시브 기업 팀들과 함께 테스크를 제작합니다. 우리와 함께하는 파트너들은 수많은 국제 CTF에서 상위권을 차지하고, 매우 깊은 수준의 보안 취약점 연구, 고난도 챌린지 제작 경험을 갖추고 있습니다. 우리는 그 중에서도 특별히 선별한 소수의 사람들과만 프로젝트를 진행합니다.

엄선된 소수만이 태스크 제작에 참여하고, 그 중에서도 극소수의 검토자만이 최종 납품 전에 모든 제출물을 엄격한 기준에 따라 검토합니다.

0xp1ain은 국제 웹 보안 연구 팀인 RewriteLab을 이끌고 있습니다. 여러 업체를 위한 사이버보안 데이터 라벨링, 벤치마크 데이터셋 품질 검토, 고난도 CTF 설계 및 운영, LLM 연구를 수행해 왔습니다. CYVARC에서는 공정한 태스크 설계와 전체 과정의 검증을 이끌고 있습니다.

sahuang은 OtterSec의 수석 AI 보안 연구자이자 국제적으로 인정받는 CTF 팀 Project Sekai의 창립자이며, 이전에는 Microsoft의 엔지니어로 근무했습니다. 사이버보안 데이터셋 제작을 이끌고 국제 CTF에 참가한 경험을 바탕으로, CYVARC에서는 데이터셋 구조, 보상 무결성, 기술 검토를 이끌고 있습니다.
신뢰할 수 있는 사이버보안 데이터셋과 벤치마크가 필요하다면, 우리가 도울 수 있습니다.
더 강력한 모델의 학습을 위한 독창적인 사이버보안 태스크로, 전문가의 추론과 실제 태스크 완료 여부에 근거한 보상 검사를 포함합니다.
향상시키고자 하는 특정 사이버보안 역량에 집중한 파인튜닝 데이터셋으로, 여러분의 모델과 원하는 도메인, 난이도에 맞게 테스크를 구성합니다.
여러 도메인에 걸쳐 데이터셋을 구축하고 큐레이션하는 기업을 위해 전문적인 사이버보안 태스크 제작과 초기 검증을 제공합니다.
샘플 태스크를 받아보실 수 있습니다. 우리가 왜 고품질의 데이터셋인지 눈으로 직접 확인해보실 수 있습니다.
필요한 내용을 알려주세요. 고객의 파이프라인에 맞는 형식으로 계획과 가격을 제안하겠습니다.