GyaanSetu AI

AI, 머신러닝 및 LLM 인사이트.

1515 articlesDeep, practical knowledge

암호화된 추론 흔적은 보안 경계가 아닙니다

암호화된 추론 흔적은 보안 경계가 아닙니다. 새로운 연구 논문에 따르면 AI 제공업체가 추론을 처리하는 방식에 중대한 결함이 있는 것으로 나타났습니다. Anthropic, OpenAI, Google은 암호화된 r...

AI · 3 min read

앤스로픽, SPV에 수십억 달러 규모의 부채 은닉... API 가격 인상 가능성

'테세우스 인프라스트럭처(Theseus Infrastructure)'라 불리는 이 SPV는 자본을 조달하고 사모 신용 펀드를 차입하여 데이터 센터를 구축한 뒤, 이를 앤스로픽에 다시 임대할 예정입니다. 임대료로 해당 차입금을 충당해야 하므로, 숨겨진 부채 비용이 상승할 경우 개발자들은 더 높은 Claude API 요금을 부담하게 될 수 있습니다.

AI · 3 min read

구조 인식 청킹(Structure-Aware Chunking) 전환으로 RAG 적중률을 61%에서 83%로 향상

RAG 파이프라인을 노트북 환경에서 운영 환경으로 전환한 지 4개월 만에, 저자는 청킹 전략 변경만으로도 검색 적중률을 83%까지 끌어올릴 수 있음을 보여줍니다. 또한 200개의 쿼리로 구성된 평가 세트를 통해 고객에게 문제가 전달되기 전 대부분의 성능 저하를 사전에 방지할 수 있게 되었습니다.

AI · 4 min read

OpenAI 윤리 책임자 사임, 안전 팀 인력 유출 가속화

이번 사임은 2024년 슈퍼얼라이먼트(Superalignment) 그룹을 포함한 OpenAI 안전 팀의 잇따른 인력 이탈과 2023년 이사회 개편에 이은 것으로, 빠른 제품 출시와 내부 리스크 점검 사이의 심화되는 갈등을 여실히 보여줍니다.

AI · 3 min read

Accel, AI 기반 애플리케이션 성장을 지원하기 위해 5억 5천만 달러 규모의 인도 펀드 조성

Accel의 이번 5억 5천만 달러 규모의 펀드는 인도를 향한 35억 달러 규모의 글로벌 투자 확대 전략의 일환으로, AI 기반 핀테크, 첨단 제조 및 딥테크 스타트업을 목표로 합니다. 특히 기존 거대언어모델(LLM)을 활용한 애플리케이션 구축을 선호하는 전략을 취하고 있습니다.

AI · 2 min read

Anthropic, '클로드피싱(Claudefishing)' 사기 방지를 위한 모델 수준 워터마크 도입

8월 2일부터 Anthropic은 모든 Claude 생성 텍스트에 숨겨진 디지털 서명을 삽입합니다. 이는 복사 및 붙여넣기나 약간의 편집을 거쳐도 유지되는 토큰 수준의 워터마크입니다. 이번 조치는 EU AI 법(EU AI Act)의 투명성 규정을 준수하는 동시에, AI를 이용한 사칭 위협인 신조어 '클로드피싱(Claudefishing)'에 대응하기 위한 것입니다.

AI · 2 min read

앤스로픽, 모든 Claude 텍스트 및 이미지에 EU 규정을 준수하는 보이지 않는 워터마크 도입

앤스로픽은 시각 자료에는 C2PA 표준을, 텍스트에는 새로운 언어적 신호를 사용하여 모든 Claude 출력물(텍스트 및 이미지)에 기계 판독이 가능한 워터마크를 삽입할 예정입니다. 이는 AI 법의 8월 2일 마감 기한을 맞추기 위해 4개월의 유예 기간 내에 기존 모델을 개조하여 적용하는 방식입니다.

AI · 3 min read

Llama.cpp CUDA 수정으로 더 빠르고 안전해진 온디바이스 챗봇

b10327 릴리스는 메모리 부족(OOM) 충돌과 정확도 저하를 유발했던 스레드 블록 계산 오류를 수정했습니다. 이와 함께 NVIDIA의 NeMo 3.0과 AMD의 ROCm이 음성 도구 및 SVDQuant 지원을 추가하며 전체 로컬 AI 스택을 더욱 견고하게 만들었습니다.

AI · 3 min read

Imagine Image 2.0, OpenAI의 디자이너들을 사로잡기 위해 전문 편집 도구를 탑재하다

이 새로운 모델은 이미지 편집 분야에서 1,439점, 텍스트 투 이미지(Text-to-Image) 분야에서 1,320점의 Elo 레이팅을 기록했을 뿐만 아니라, 매직 완드, 세그멘테이션, 스마트 리사이즈와 같은 도구들을 함께 제공하여 제품 사진부터 게임 에셋에 이르기까지 전문적인 작업 파이프라인을 효율화하는 것을 목표로 합니다.

AI · 3 min read

LanceDB, pgvector보다 22배 빠른 10만 개 임베딩 처리 속도

이번 테스트에서 10만 개의 1536차원 OpenAI 임베딩을 인덱싱한 결과, LanceDB는 데이터를 훨씬 더 빠르게 로드할 뿐만 아니라 pgvector가 사용하는 저장 공간의 약 3분의 1만 사용한다는 사실이 밝혀졌습니다. 반면, pgvector는 클라이언트당 프로세스(process-per-client) 모델을 통해 동시성 측면에서 우위를 점했습니다.

AI · 3 min read

800만 달러 규모의 AI 음악 로열티 사기 사건 이후, Suno가 대량 다운로드 제한 조치 시행

자사 모델이 저작권이 있는 곡을 복제할 수 있다는 독일 법원의 판결과 800만 달러 규모의 대형 로열티 사기 사건에 직면한 Suno는, 프롬프트 필터를 강화하고 Audible Magic 및 Musixmatch 스캔 기능을 통합하는 한편 사용자가 한 번에 다운로드할 수 있는 트랙 수를 제한하고 있습니다.

AI · 5 min read

Roku, Fairground와 함께 24시간 AI 생성 FAST 채널 선보여

이 신규 채널은 애니메이션 스타일의 클립, 저예산 CGI, 공포 단편 영상, 그리고 판타지 형식으로 재해석한 '오디세이' 등을 혼합하여 보여주지만, 시청자들은 영상 품질이 매우 불균형하고 광고 삽입이 몰입을 방해한다고 지적합니다.

AI · 2 min read