EvoHarness-RL: 장기 지평 LLM 에이전트를 위한 자기 진화 런타임 하네스 학습
목차 개요 배경과 문제 정의 방법론 BPE 하네스 추상화 에이전트-하네스 액션 프로토콜 ALFWorld 환경 어댑터 2단계 학습 파이프라인 실험 설정 주요 결과 메인 결과 BPE 컴포넌트 제거 실험 미지 환경 일반화 ...
목차 개요 배경과 문제 정의 방법론 BPE 하네스 추상화 에이전트-하네스 액션 프로토콜 ALFWorld 환경 어댑터 2단계 학습 파이프라인 실험 설정 주요 결과 메인 결과 BPE 컴포넌트 제거 실험 미지 환경 일반화 ...
목차 개요 실험 설계 훈련 환경 구성 훈련 중 행동 진화 주요 결과 사이버 공격 시뮬레이션 유해 요청 응답 분포 외 보상 조작 안전 모니터 우회 광범위 정렬 평가 모델의 자기 인식 관련 관찰 한계와 주의사항 ...
목차 개요 진단: 이 스파이크는 정상인가 개입하지 않아도 되는 스파이크와 개입해야 하는 스파이크 gradient norm은 loss보다 먼저 튄다 소규모 모델의 스파이크는 원인이 다르다 원인: Adam과 weight decay가 만드는 불안정 2차 모멘트 감쇠와...
목차 개요 배경 워터마크 동작 원리 토큰 선택의 무작위성 재정의 SynthID-Text 채택 적용 범위 콘텐츠 유형별 차이 이미지와 파일은 C2PA 품질과 비용에 미치는 영향 탐지 방법과 한계 프라이버시와 권리 결론 Refer...
목차 개요 문제 의식 소형 에이전트의 메모리 빈곤 단순 교사 메모리 전달이 실패하는 이유 관련 연구 방법론 문제 정식화 세 가지 계층 메모리 생성 능동 주입과 반응형 주입 실험 설정 주요 결과 벤치마크 정확...
목차 개요 배경과 문제의식 기존 문장 임베딩 방식의 두 갈래 풀링과 마지막 은닉 상태의 한계 방법론 모델 구조 Self-Attention 메커니즘 다중 hop과 2D 행렬 임베딩 페널티 항 시각화 방법 관련 연구...
목차 개요 배경과 관련 연구 기존 연구의 초점은 공간 정보였다 어텐션과 게이팅 메커니즘 방법론 SE 블록의 전체 구조 Squeeze: 전역 정보 임베딩 Excitation: 적응형 재보정 기존 아키텍처와의 통합 모델 복잡도와 연산...
목차 개요 배경 핵심 변경사항 스테이트리스 코어 전환 server/discover와 버전 협상 MRTR: 다중 왕복 요청 패턴 알림 채널의 재설계 인프라 친화적 헤더와 캐싱 인증과 보안 강화 Tasks 확장으로의 분리 Deprecate...