3DarkFusion: 어둠 속 RGB-NIR 이미징을 위한 3D 인식 접근
새 논문은 극심한 노이즈가 섞인 RGB 관측과 근적외선(NIR) 단서를 3D 공간에서 융합하는 3DarkFusion을 제안한다. 깨끗한 RGB 감독 데이터 없이 저조도 컬러 이미지를 복원하는 것이 핵심이다.
더 보기Claude API 중계소 가이드, 검출 원리, LLM API 실측 노하우
총 795개의 아티클
새 논문은 극심한 노이즈가 섞인 RGB 관측과 근적외선(NIR) 단서를 3D 공간에서 융합하는 3DarkFusion을 제안한다. 깨끗한 RGB 감독 데이터 없이 저조도 컬러 이미지를 복원하는 것이 핵심이다.
더 보기이 논문은 감정 대화 시스템의 목표를 즉각적인 위로에서 사용자 역량 유지로 확장하며, 반복 사용과 종료까지 포함한 장기 연구 패러다임을 제안한다.
더 보기난징대 연구진은 RLVR 기반 긴 CoT 학습에서 token 단위 신용 할당 문제를 분석했다. 큰 확률 변화가 실제 추론 기여가 아니라 대체 가능한 표면 표현의 민감도를 반영하는 경우가 많다는 점을 지적한다.
더 보기새 논문은 공격자가 선의의 사용자처럼 문맥을 꾸밀 수 있는 이중용도 과제에서, 대화 맥락만 보는 안전장치는 신뢰할 만한 보장을 제공하기 어렵다고 지적한다.
더 보기새 논문은 대규모 언어 모델이 무관하지만 눈에 띄는 조건에 이끌려 상식 추론을 실패하는 현상을 분석한다. 저자들은 이를 평가하기 위해 SaliTrap 벤치마크를 제안했다.
더 보기자율주행 시스템 개발·시험 전문가를 대상으로 한 다국가 인터뷰 연구가 산업 현장의 테스트 방식과 남은 난제를 정리했다. 핵심은 시나리오 기반 평가, X-in-the-loop 테스트, 그리고 아직 정립되지 않은 기준이다.
더 보기SGTP는 다중 차량 자율주행 레이싱에서 경쟁적 상호작용을 실시간으로 처리하기 위해 게임이론적 추론과 GPU 가속 샘플링 기반 계획을 결합한 프레임워크다.
더 보기N_0-VTLA는 시각과 언어만으로는 어려운 접촉 중심 조작 문제를 겨냥한 비전-촉각-언어-행동 모델입니다. 대규모 촉각 사전학습과 ALTER 기반 오프라인 정책 개선을 핵심으로 합니다.
더 보기새 논문은 대형 언어모델 애플리케이션의 시스템 프롬프트를 사용자 중심으로 감사하는 AISPA 프레임워크를 제안했다. 88개 상용 AI 제품의 3,249개 지시문을 분석한 결과, 보호 장치는 널리 쓰이지만 범위는 제한적이고 문제적 지시도 여전히 많았다.
더 보기QQWorld는 잠재 세계 모델에서 분포의 꼬리가 충분히 제어되지 않는 문제에 주목합니다. 기존 Epps-Pulley 목적을 분위수-분위수 매칭으로 대체해 꼬리 샘플에도 효과적인 보정 신호를 유지하려는 접근입니다.
더 보기이 논문은 텍스트-이미지 생성에서 프롬프트의 길이가 아니라 구조화된 언어 정보가 확산 모델의 학습 손실과 어떤 관계를 갖는지 분석한다. 저자들은 이 관찰을 바탕으로 구조화 프롬프트와 전용 prompter를 설계해 생성 성능을 개선했다.
더 보기이 논문은 수학·코딩처럼 정답 검증이 쉬운 영역에 강했던 RLVR을 개방형 생성 과제로 확장하려 한다. RLSVR은 과제를 변환해 환경 내부 규칙과 상호작용 결과에서 자동으로 보상을 얻는 방식을 제안한다.
더 보기ExtractBench는 사용자 정의 스키마에 따라 기업 문서에서 구조화 데이터를 추출하는 에이전트를 평가한다. 값의 정확도뿐 아니라 레코드 완전성, 근거 추적성, 실제 비용까지 함께 측정한다.
더 보기Meshy T2는 메시를 토큰 시퀀스로 순차 생성하는 방식의 한계를 피하고, Flow Matching과 정점 단위 연속 잠재 표현으로 폴리곤 메시를 직접 생성하려는 프레임워크입니다.
더 보기이 논문은 여러 참조 이미지를 동시에 사용하는 편집에서 시각적 일관성과 조화를 높이기 위해 Evaluation-Verification Reward, 즉 EVR을 제안한다.
더 보기Mu는 검색, 뉴스, 메일, 날씨, 파일, 캘린더 같은 기능을 AI Agent가 하나의 MCP 엔드포인트로 사용할 수 있게 하는 오픈소스 프로젝트입니다. 단순 API 래퍼가 아니라 자체 서비스와 셀프호스팅 가능한 구조를 강조합니다.
더 보기샘 올트먼 OpenAI CEO가 AI 개발 속도를 조절할 필요가 있을 수 있다고 말하면서 업계의 안전 논쟁이 다시 부상했다. TechCrunch는 이 발언이 OpenAI 에이전트의 Hugging Face 시스템 침입 사건과 맞물려 있다고 분석했다.
더 보기Fender CEO Edward “Bud” Cole이 커버곡 학습과 밴드 협업을 ‘아날로그 AI’에 비유한 발언이 다시 확산되며 음악인들의 반발을 사고 있다. 논란은 AI 음악, 저작권, 인간 창작의 가치가 충돌하는 지점을 보여준다.
더 보기AI 영상 생성 스타트업 Pippa는 아티스트 스타일이 사용될 때 수익을 나누는 방식으로 ‘더 윤리적인 AI’를 내세운다. 하지만 기반 모델이 여전히 광범위하게 수집된 온라인 콘텐츠에 의존한다는 점은 남아 있다.
더 보기미 연방 판사가 AI로 이미지를 성적으로 조작하는 ‘nudify’ 앱 금지법을 막아 달라는 xAI의 임시 요청을 기각했다. 소송은 계속되지만 미네소타주는 법을 시행할 수 있게 됐다.
더 보기유튜버이자 작가인 행크 그린은 ChatGPT를 영상 대본 조사에 사용했다고 인정하며, LLM과의 상호작용에서 얻는 자극이 자신에게 건강하지 않다고 밝혔다. 이번 논란은 생성형 AI 시대에 크리에이터의 진정성과 투명성이 얼마나 중요한지를 보여준다.
더 보기