VLM 취약성의 내부 스펙트럼
트랜스포머 VLM의 적대 취약성을 중간 계층 스펙트럼 부분공간으로 해석하는 연구 흐름을 짚는다.
트랜스포머 VLM의 적대 취약성을 중간 계층 스펙트럼 부분공간으로 해석하는 연구 흐름을 짚는다.
정부와 기업의 비공개 협의만으로 프런티어 AI 출시 안전성을 판단해도 되는지, 검증과 책임의 공백을 짚는다.
지난 수집 자료(공식/뉴스) 중 중요한 링크를 모아 정리했다.
형태가 바뀌는 모듈형 소프트 로봇 팔 제어를 지속학습으로 다룬 arXiv 논문을 살핀다.
Gimitest는 변하는 조건에서 RL 정책의 실패, 취약성, 평가 편향을 찾는 통합 테스트 프레임워크다.
에이전트형 AI의 자율성, 도구 호출, 외부 실행을 감독하는 거버넌스 핵심을 짚는다.
HIVE는 VLM 환각이 이후 추론과 판단을 얼마나 오염시키는지 분리해 평가하는 관점을 제시한다.
VASP Agent가 입력 일관성, 장시간 계산 감독, 출력 검증을 묶는 과학 계산 자동화 프레임워크임을 짚는다.
긴 영상을 순차 처리하는 AI의 한계와 계층적 메모리·에이전트형 추론의 의미를 짚는다.
LLM 성능 향상과 사무 자동화가 곧바로 전기료·월세·식료품값 인하로 이어지지 않는 이유를 짚는다.
텍스트 로그 대신 객체 중심 실행 모델로 에이전트 메모리를 재설계해야 하는 이유를 짚는다.
MARL 사회적 딜레마에서 이타성과 공정성을 결합한 효용 함수로 협력 안정성을 높이는 접근을 다룬다.
GPU보다 시급한 과제는 AI 신뢰성 인력과 TEVV 기반 운영 체계 점검이다.
한국이 AI 에이전틱 커머스를 산업 전략으로 올리며, 성장과 규제 설계가 함께 시작됐다는 신호를 보냈다.
영국 당국이 자녀 사진 공개 범위 축소를 권고했다. AI 악용과 플랫폼 책임 쟁점을 짚는다.
가정용 요리 휴머노이드는 외형보다 성공률·시간·안전성·비용으로 평가해야 한다.
지난 수집 자료(공식/뉴스) 중 중요한 링크를 모아 정리했다.
스타크래프트 II 잠재공간으로 반사실 피드백을 만드는 RL 연구와 코칭 활용 가능성을 짚는다.
DART-VLN은 재학습 없이 테스트 단계 제어만으로 discrete VLN의 메모리 오류와 루프를 줄이려 한다.
단안 비디오에서 자유 시점용 동적 3D Gaussian을 만들고 결손을 생성형 비디오 조건으로 보정하는 접근.
야외 로봇의 NTN 통신에서 순간 채널 대신 과거 상태와 작업 맥락을 반영하는 설계 필요성을 짚는다.
지난 수집 자료(공식/뉴스) 중 중요한 링크를 모아 정리했다.
고정 로그만으로 멀티에이전트 게임을 풀 때, 후보 균형의 보수성과 데이터 커버리지가 regret를 어떻게 좌우하는지 짚는다.
리듬게임 AI는 기능별로 API와 로컬 추론을 나눠 지연, 비용, 한도, 메모리를 함께 설계해야 한다.