GyaanSetu AI

AI, 머신러닝 및 LLM 인사이트.

1515 articlesDeep, practical knowledge

AWS, Bedrock에서 AI 호출 자동 결제를 위한 x402 ‘AgentCore Payments’ 도입

새로운 x402 프로토콜은 각 HTTP 요청에 결제 토큰을 포함하여, AI 에이전트가 데이터, 컴퓨팅 또는 API 호출에 대한 비용을 자동으로 차감할 수 있도록 합니다. AgentCore Payments로 불리는 AWS Bedrock 통합 기능은 원활한 머신 커머스를 위해 내장 지갑과 지출 한도 설정 기능을 제공합니다.

AI · 3 min read

Carebricks 에이전트, 5,500만 달러 규모의 투자 유치 후 검사 주문 및 케어 플랜 자동화 추진

Sequoia, Felicis, Optum Ventures 및 Y Combinator의 지원을 받는 Bunkerhill은 EHR 데이터를 추출하고 검사를 주문하며 케어 플랜을 업데이트할 수 있는 소프트웨어인 Carebricks 에이전트의 파일럿 도입을 계획하고 있으며, 이를 통해 임상의의 일상적인 조정 업무 부담을 완화하는 것을 목표로 합니다.

AI · 2 min read

SEED, 훈련 데이터 40% 절감하며 ALFWorld 점수 91.8로 향상

SEED 프레임워크는 에이전트가 자신의 트랜스크립트를 읽고 자연어 형태의 교훈을 작성한 뒤, 이를 정책 업데이트로 정제하는 에피소드 종료 후 단계(post-episode pass)를 추가하여, 희소한 보상 신호를 풍부하고 재사용 가능한 훈련 신호로 전환합니다.

AI · 4 min read

MCP v2, 핸드셰이크와 세션 ID 제거로 진정한 서버리스 스케일링 구현

2026년 7월 28일 출시되는 MCP 버전 2는 초기화 핸드셰이크, Mcp-Session-Id 헤더 및 3개의 레거시 서브시스템을 제거하여 프로토콜을 완전히 상태 비저장(stateless) 방식으로 만듭니다. 이제 팀은 세션 어피니티(session-affinity) 제약 없이 오토스케일링 또는 서버리스 포드에서 실행할 수 있습니다.

AI · 3 min read

Google Gemma-4 31B, AWS Inferentia에서 토큰 일치 테스트는 통과했으나 의미 없는 말만 쏟아내

Inferentia2 INF2.24xlarge는 CPU 레퍼런스와 정확히 일치하는 토큰 스트림을 재현했으나, 두 실행 모두 채팅 템플릿과 턴 마커가 누락된 잘못된 프롬프트가 입력되어 Gemma-4가 무의미한 말을 반복하는 무한 루프에 빠졌습니다. 하드웨어는 단지 레퍼런스 코드의 버그를 그대로 재현했을 뿐입니다.

AI · 3 min read

모든 토큰을 기록해 LLM 에이전트 비용을 31% 절감하여 651달러로 낮춘 1인 연구자

모델명, 토큰 수, 작업 유형 및 호출당 비용을 기록하는 PostgreSQL 로깅 레이어를 추가함으로써, 연구자는 가공되지 않은 SEC 검색 결과가 프롬프트 크기를 부풀리고 있다는 점을 파악했습니다. 해당 결과를 요약하고 간단한 확인 작업은 더 저렴한 모델로 라우팅함으로써 31%의 비용 절감을 달성하고 정확도 또한 향상시켰습니다.

AI · 3 min read