GyaanSetu AI

AI, 머신러닝 및 LLM 인사이트.

1515 articlesDeep, practical knowledge

Fable 5의 '비전 전용' 포켓몬 플레이는 실제 인지력이 아닌 치트 시트에 불과했다

Anthropic의 Fable 5를 중국어판 포켓몬스터 파이어레드에서 실행했을 때, 이 모델은 단돈 65.40달러로 1,785턴 만에 첫 번째 체육관 배지를 획득했다. 하지만 로그 분석 결과, 화면에 이벤트가 나타나기도 전에 이를 반복적으로 언급한 것으로 드러났으며, 이는 모델이 진정한 시각적 추론이 아닌 암기된 게임 스크립트에 의존했음을 증명한다.

AI · 4 min read

Flux 3, BFL 테스트에서 93% 선호도로 Luma Ray 3.2 압도

BFL 벤치마크 결과, Flux 3는 Luma Ray 3.2 대비 93%, Runway Gen-4.5 대비 77%, 그리고 이전 모델인 Seedance 2.0보다도 52% 높은 점수를 기록하며 모든 경쟁 모델을 제쳤습니다. 또한, Self-Flow와 다국어 오디오 기능도 새롭게 선보였습니다.

AI · 2 min read

GraphVid, 상호작용 그래프를 통해 FID 39.9% 및 FVD 37.6% 절감

GraphVid는 수동으로 그린 궤적을 고수준 상호작용 그래프로 대체하여, 모델이 가려짐(occlusion) 상황에서도 일관된 움직임을 추론할 수 있게 합니다. 새로운 GraphVid-Bench로 학습된 이 모델은 더 적은 파라미터로도 더 선명한 질감(PSNR 15.98)과 더 높은 유사도(SSIM 0.61)를 제공합니다.

AI · 2 min read

7월 28일 MCP 세션 ID 폐지 – 코드 재작성 필수, 미조치 시 라우팅 오류 발생

7월 28일 업데이트로 핸드셰이크와 세션 ID가 제거됨에 따라, 모든 요청에 전체 컨텍스트를 포함해야 합니다. 팀은 인메모리 세션 맵, 스티키 로드 밸런서 설정, 세션별 캐시를 반드시 점검해야 하며, 이를 소홀히 할 경우 라우팅 오류, 캐시 미스, 백그라운드 작업 폭주 등의 위험이 따를 수 있습니다.

AI · 3 min read

전문가들, "필터링되지 않은 AI 접근이 해커들의 제로데이 취약점 제작을 허용할 수 있다"고 경고

두 기업 모두 해당 프로그램이 통제된 버그 바운티 활동의 일환이라고 밝히고 있지만, 비판론자들은 자격 증명이 도난당하거나 검증 절차가 우회될 경우 공격자들이 동일한 제한 없는 모델을 사용하여 피싱 스크립트, 제로데이 코드 및 맞춤형 사회 공학적 프롬프트를 생성할 수 있다고 지적합니다.

AI · 2 min read

AI 대화의 빠진 조각

AI 대화의 빠진 조각. 모두가 AI 에이전트에 대해 이야기하고 있습니다. 어떤 테크 피드를 훑어보더라도 거대 언어 모델이 예약하는 모습을 보여주는 수십 개의 데모를 쉽게 찾아볼 수 있습니다...

AI · 6 min read