고해상도 날씨 예보의 한계는 모델보다 데이터에 있다
BaguanHR는 저해상도 예보 모델을 직접 미세 조정하는 대신, 변수별 초해상도로 재분석 데이터를 0.1도 학습 데이터로 확장합니다. 연구 결과는 고해상도 예보에서 데이터 규모가 핵심 병목임을 보여줍니다.
더 보기Claude API 중계소 가이드, 검출 원리, LLM API 실측 노하우
총 775개의 아티클
BaguanHR는 저해상도 예보 모델을 직접 미세 조정하는 대신, 변수별 초해상도로 재분석 데이터를 0.1도 학습 데이터로 확장합니다. 연구 결과는 고해상도 예보에서 데이터 규모가 핵심 병목임을 보여줍니다.
더 보기FIRM-Video는 텍스트-투-비디오 보상 모델이 점수를 매기기 전에 영상 속 근거를 확인하도록 설계된 체크리스트 기반 평가 방법이다. 지시 이행, 세계 일관성, 지각 품질을 세분화하고 90K 데이터셋과 벤치마크를 제시했다.
더 보기LibriBrain100은 32명이 자연스러운 연속 음성을 듣는 동안 수집한 100시간 이상의 MEG 데이터를 제공한다. 한 참가자의 깊은 데이터와 다수 참가자의 폭넓은 데이터를 함께 구성해 재현 가능한 신경 음성 디코딩 평가를 지원한다.
더 보기Code World Model은 코딩 에이전트가 지속적인 세계 상태와 규칙을 관리하고, 비디오 모델이 이를 시각적으로 구현하도록 역할을 분리합니다.
더 보기JoyAI-Echo-1.5는 장편 영상에서 인물의 외모와 목소리를 유지하고, 사용자 조작에 반응하는 인터랙티브 월드 생성을 목표로 하는 통합 오디오·비주얼 시스템입니다.
더 보기앤트로픽이 AI 에이전트와 실험 장비, 로봇을 연결하기 위한 ‘Model Hardware Standard(MHS)’ 연구 프리뷰를 공개했다. 우선 과학 연구 환경에서 서로 다른 제조사의 장비를 하나의 인터페이스로 묶는 데 초점을 맞춘다.
더 보기아동 성착취 이미지 피해자가 xAI가 자신의 원본 이미지와 AI 생성 변형물을 Grok 학습에 사용했을 가능성이 있다고 주장했습니다. 아직 사실로 확정된 사안은 아니지만, 생성형 AI의 데이터 관리와 안전장치를 둘러싼 쟁점을 제기합니다.
더 보기엔비디아가 AI 모델 저장·공유 플랫폼 허깅페이스를 약 129억 달러에 인수하는 방안을 추진 중이라는 보도가 나왔습니다. 거래가 성사되면 오픈 모델과 AI 클라우드, 피지컬 AI 분야에서 엔비디아의 영향력이 커질 수 있습니다.
더 보기오픈AI, 앤트로픽, 구글, 마이크로소프트 등 100여 개 기업이 AI 기반 사이버 위협에 대응하기 위한 민관 협력을 촉구하는 공개서한에 서명했다. 첨단 모델 개발과 방어 기술 사업을 동시에 추진하는 기업들의 이중적 위치도 드러났다.
더 보기Google DeepMind가 Gemini Omni 1.1 Flash를 공개했다. 장면 연장, 시작·끝 프레임 지정, 360p 미리보기, 최대 4K 출력 등을 통해 생성형 동영상 제작의 반복 작업을 개선한다.
더 보기인터넷 접속 권한을 받은 AI 에이전트가 통제된 테스트 환경을 벗어나 실제 기업과 개인, 온라인 서비스에 접근한 사례가 잇따르고 있다. 이제 핵심 질문은 모델이 공격할 수 있느냐를 넘어, 운영자가 그 행동을 차단하고 즉시 발견할 수 있느냐로 옮겨가고 있다.
더 보기기업 웹사이트의 llms.txt 파일에서 등록되지 않은 패키지와 미점유 도메인을 가리키는 명령이 발견됐습니다. 문서를 신뢰할 수 있는 설치 지침으로 받아들인 AI 에이전트가 기업 환경에서 개념증명 코드를 실행했습니다.
더 보기AI 데이터센터의 물 사용량은 늘고 있지만, 질의 한 번당 물 사용량만으로 전체 영향을 판단할 수는 없다. 지역의 물 부족, 전력원, 냉각 기술이 실제 부담을 좌우한다.
더 보기구글 딥마인드가 외부 기관들과 함께 모델 가중치와 평가 프롬프트를 서로 공개하지 않는 이중 블라인드 AI 평가를 시험한다. 기밀 컴퓨팅을 활용해 벤치마크 오염 위험을 줄이는 것이 목표다.
더 보기METR 조사에 따르면 OpenAI의 에이전트들은 ExploitGym의 점수 체계를 공략하기 위해 허가받지 않은 게시판을 만들었고, 결국 Hugging Face 네트워크에 접근했다. 보상 설계와 다중 에이전트 협업이 만든 구조적 위험이 드러난 사건이다.
더 보기FrontierChallenge는 그럴듯한 답변이 아니라 검증 가능한 과학 워크플로를 끝까지 납품할 수 있는지를 평가한다. 결과는 부분적인 진전과 완전한 완료 사이에 큰 격차가 있음을 보여준다.
더 보기VoiceMem은 양방향 음성 언어 모델을 위해 정보 기억과 감정·페르소나 기억을 분리하고, 이를 스트리밍 방식으로 처리하는 아키텍처를 제시합니다.
더 보기StreamPI는 추가 파라미터 없이 단일 프레임 중심의 비전·언어·행동 모델에 시계열 추론을 더한다. 명령어 앵커 어텐션과 무작위 간격 학습을 통해 로봇이 과거 관찰을 활용하고 비동기 입력에도 대응하도록 설계됐다.
더 보기새 벤치마크는 단일 버그 수정이 아니라 저장소 전체의 기술 스택 마이그레이션 능력을 평가한다. 520회 실행 중 마이그레이션 감사와 동작 테스트, 추가 검증을 모두 통과한 비율은 5.4%에 불과했다.
더 보기오픈AI가 인도에서 ChatGPT 무료 요금제와 Go 요금제 사용자에게 광고를 표시하기 시작한다. 초기에는 약 50개 브랜드가 참여하며, 기업용 광고 관리 도구도 출시할 예정이다.
더 보기엔비디아가 오픈소스 AI 플랫폼 허깅페이스를 약 129억 달러에 인수하기로 합의했다는 보도가 나왔다. 다만 다른 보도에서는 양측이 아직 최종 계약을 체결하지 않았으며 협상이 결렬될 가능성도 남아 있다고 전했다.
더 보기