GyaanSetu AI

AI, 머신러닝 및 LLM 인사이트.

1515 articlesDeep, practical knowledge

MIT 연구 결과, AI 팩트 체크가 오히려 사용자의 가짜 뉴스 판별 능력을 저하시키는 것으로 나타났다

67명을 대상으로 한 4주간의 실험에서, MIT 연구진은 정확도가 높은 AI가 뉴스 기사에 대해 참/거짓 판결을 내리도록 했다. AI가 대부분의 경우 정확한 판단을 내렸음에도 불구하고, AI에 의존했던 사용자들은 AI가 없을 때 오정보를 판별하는 능력이 눈에 띄게 떨어지는 것으로 나타났다.

AI · 2 min read

Gemini에서는 이미지가 텍스트보다 유리: 수학, 비라틴 문자 및 표는 비용이 더 저렴합니다

Google의 Gemini는 이미지 토큰을 768픽셀 타일 단위로 계산하며, 타일당 258토큰을 부과합니다. 이미지를 한 타일 미만으로 유지하거나 수식, 표, 비라틴 문자 등 밀도가 높은 데이터를 처리하는 데 이미지를 활용하면, 개발자는 동일한 정보를 텍스트로 전달할 때보다 훨씬 적은 비용을 지불할 수 있습니다.

AI · 3 min read

Claude Code 작업의 75%는 '읽기'입니다

Claude Code 작업의 75%는 '읽기'입니다. 대부분의 사람들은 AI 코딩 에이전트가 코드를 작성하는 데 시간을 보낸다고 생각하지만, 새로운 데이터는 이것이 잘못되었음을 보여줍니다. Red Hat은 219개의 실제 Claude Code 세션을 분석했습니다. T…

AI · 3 min read

ETag 조건부 쓰기를 활용한 버전 관리 체크포인트로 LangGraph 데이터 손실 방지

몇 주간 지속된 상태 데이터 손실 문제를 해결하기 위해 SQLite, 로우 오브젝트 스토리지, 결함이 있는 하이브리드 방식 등을 시도한 끝에, 저자는 ETag 기반 조건부 쓰기를 적용한 버전 관리 엔벨로프(versioned envelope) 방식에 도달했습니다. 이 방식은 동시 덮어쓰기를 방지하고 신뢰성을 회복하는 원자적 업데이트 루프를 구현합니다.

AI · 3 min read

Claude 프롬프트 캐싱이 조용히 실패합니다

Claude 프롬프트 캐싱이 조용히 실패합니다. 사용 중인 Claude 프롬프트 캐싱이 실패하고 있을 수도 있지만, 이를 전혀 인지하지 못할 수도 있습니다. WhatsApp 핸들러에 캐시 제어를 추가한 후 로그를 살펴보던 중...

AI · 3 min read

Claude Opus 5 프롬프트 캐싱, 첫 호출 이후 챗봇 토큰 비용 90% 절감

새로운 캐시 쓰기 비용은 5분 또는 1시간 TTL(유효 기간)에 따라 기본 가격의 1.25배 또는 2배가 발생하지만, 이후 모든 히트(hit)는 단 0.1배의 비용만 청구됩니다. 따라서 변경되지 않는 컨텍스트를 미리 로드해 두면 심도 있는 대화도 일회성 비용으로 처리할 수 있습니다.

AI · 3 min read

AI 모더레이션 도입으로 레딧 신규 사용자 게시물 22% 급증, 스팸 수치는 유지

r/technology와 같은 서브레딧에서 진행된 초기 파일럿 테스트 결과, 레딧의 AI 기반 모더레이션은 스팸 및 괴롭힘 신고 비율을 일정하게 유지하면서도 신규 게시자의 활동을 22% 증가시켰습니다. 이는 해당 모델이 안전을 저해하지 않으면서도 커뮤니티 진입 장벽을 낮출 수 있음을 보여줍니다.

AI · 2 min read

GraphRAG + 지속성 메모리, 탭을 닫아도 챗봇이 정보를 잊지 않게 합니다

GraphRAG는 검색된 텍스트를 엔티티와 관계의 그래프로 변환하여 모델이 여러 문서에 걸쳐 추론할 수 있게 하며, 3단계 컨텍스트 메모리는 단기 대화, 장기 사용자 정보, 그리고 선택적으로 정제된 데이터를 저장하여 페이지 새로고침이나 새 탭에서도 정보가 유지되도록 합니다.

AI · 3 min read

Neon 폴링 간격을 15분으로 연장하여 컴퓨팅 비용 절감

클라이언트 측 새로고침 간격을 30초에서 15분으로 늘림으로써, Neon 데이터베이스가 'scale to zero'를 수행할 수 있을 만큼 충분한 유휴 상태를 유지할 수 있게 되었습니다. 이를 통해 이전 Vercel 비용 대시보드에서 급증했던 초 단위 컴퓨팅 비용을 제거할 수 있었습니다.

AI · 2 min read

Claude 계층화를 통한 API 비용 35% 절감 및 지연 시간 27초로 단축

저자는 작업의 모호성에 따라 Haiku, Sonnet 또는 Opus로 작업을 매핑하는 정적 룩업(static lookup)을 구축하고, 2회 실패 시 에스컬레이션 규칙을 추가했습니다. 4주 동안 이 시스템은 품질을 유지하면서 API 비용을 기존의 65% 수준으로 낮추고, 중앙값 처리 시간을 42초에서 27초로 단축했습니다.

AI · 3 min read