딥마인드, 7,500개의 합성 클립을 활용해 140억 파라미터 규모의 멀티태스크 비전 모델 개발
알리바바의 Wan2.1 아키텍처를 기반으로 구축된 이 모델은 아주 작은 규모의 Blender 렌더링 데이터셋을 통해 깊이, 법선, 세그멘테이션, 3D 포즈를 학습하며, 훨씬 적은 양의 학습 데이터만으로도 전문 시스템과 대등하거나 이를 능가하는 성능을 구현합니다.
AI, 머신러닝 및 LLM 인사이트.
알리바바의 Wan2.1 아키텍처를 기반으로 구축된 이 모델은 아주 작은 규모의 Blender 렌더링 데이터셋을 통해 깊이, 법선, 세그멘테이션, 3D 포즈를 학습하며, 훨씬 적은 양의 학습 데이터만으로도 전문 시스템과 대등하거나 이를 능가하는 성능을 구현합니다.
이 새로운 멀티모달 모델은 이미지, 비디오 클립, 복잡한 문서를 읽고 코드를 생성할 수 있어, 풀스택 개발, 고급 분석 및 사무 워크플로우 자동화에 최적화되어 있습니다.
LongStraw의 branch-replay 기술은 롤아웃 브랜치 전반에 걸쳐 공유된 프롬프트 접두사를 캐싱합니다. 이는 재계산 및 분기된 꼬리(divergent tail) 부분만 역전파하는 대신 이를 다시 재생(replay)함으로써, 긴 컨텍스트 RL에서 연산량을 8~16배 절감합니다.
해당 저장소에는 Rust 기반의 하네스, 터미널 UI 및 도구 레이어가 포함되어 있으나 모델 가중치는 포함되어 있지 않아 사용자가 직접 모델을 제공해야 합니다. 이슈(Issues)와 풀 리퀘스트(pull requests) 기능은 비활성화되어 있어 커뮤니티의 기여는 제한되지만, 개발자들이 데이터 처리 코드를 감사할 수 있도록 했습니다.
이번 실험에서 Codex는 프로젝트 계획 초안 작성, 약 2,500행에 달하는 18개의 소스 파일 작성, Git 저장소 관리, DOS 실행 파일 빌드, 그리고 스스로 버그 수정까지 모든 과정을 수행했습니다. 인간의 개입은 목표 정의, 버그 보고, 플레이 테스트에만 국한되었습니다.
실험 결과, 객관적인 레드라인 조건을 사용하는 에이전트는 평균 3.3회의 반복만으로 중단된 반면, 자기 판단에 의존하는 에이전트는 작업을 완료하지 못한 채 8단계의 하드 리밋에 도달하여 불필요한 사이클 낭비와 결과 왜곡을 초래하는 것으로 나타났습니다.
RAG 시스템의 임계값 함정. 하드코딩된 유사도 임계값은 위험합니다. 저는 RAG 시스템에 0.50의 기본 임계값을 사용했습니다. 코사인 유사도가 이 수치 아래로 떨어지면...
RT-2, OpenVLA, GR00T, LeRobot, Pi-Zero 등 5개의 VLA 모델은 카메라 피드, 자연어 명령, 모터 출력을 결합하여, 로봇이 미리 프로그래밍된 단계별 시퀀스 대신 음성 명령에 따라 직접 행동할 수 있게 합니다.
TELUS의 파일럿 프로젝트는 기준 지표를 측정하고 다양한 AI 페어 프로그래머를 시험하며 사이클 타임 단축을 추적했습니다. 이를 통해 체계적인 도입이 일상적인 코드 생성을 수백만 달러 규모의 효율성 엔진으로 전환할 수 있음을 입증했습니다.
Anthropic, Claude Fable 5 사용 제한 대폭 축소 및 프로 사용자를 API로 전환. Anthropic은 수요가 높은 Claude Fable 5 모델에 대한 사용자 액세스 방식을 대폭 재편하며, 더 엄격한 제한을 도입하고 있습니다...
상하이 세계 AI 컨퍼런스에서 Moonshot AI는 가중치가 완전히 공개된 2.8조 파라미터 규모의 전문가 혼합(MoE) 모델인 Kimi K3를 발표했습니다. 이는 미국이 통제하는 API를 넘어 중국을 고성능 AI의 강력한 경쟁자로 자리매김하게 합니다.
Bionic은 모델에 구애받지 않는 인터페이스, 내장된 에이전트 프리미티브, LM Studio IDE와의 직접적인 통합을 제공하여, 개발자가 OpenAI 호환 모델이나 로컬 호스팅 모델 등 어떤 모델에서도 어시스턴트를 프로토타이핑, 테스트 및 배포할 수 있도록 지원합니다.
Mozilla의 분석에 따르면 토큰당 비용이 50배 절감되고 성능 격차가 좁혀짐에 따라, 개발자들이 비용 절감, 빠른 반복 작업, 규제 준수를 위해 오픈 웨이트 모델을 선호하는 추세입니다.
에이전트 비용 드리프트: 보이지 않는 세금. 저는 매일 두 개의 기사를 작성하는 AI 에이전트를 운영하고 있습니다. 주제가 중복되는 것을 방지하기 위해, 에이전트는 작업을 시작하기 전 작업 로그 파일을 읽습니다. 이 파일은...
비교 테스트에서 GPT-5.6-SOL은 확률 문제, 도르래-관성 시나리오, 복잡하게 얽힌 Python 백팩 스크립트를 해결한 반면, Kimi K3는 토큰 제한에 걸리거나 시간 초과가 발생하여 사용할 수 있는 결과물을 출력하지 못했습니다.
비교 테스트 결과, GPT-5.6-SOL은 동일한 토큰 제한 내에서 세 가지 복잡한 수학, 물리학 및 코딩 과제를 완수했으나, Kimi K3는 반복적으로 토큰 한도에 도달하며 타임아웃이 발생해 개발자들에게 최종 답변을 제공하지 못했습니다.
A Match Group poll of 1,000 U.S. adults 18-39 shows almost half distrust AI in romance, yet Bumble, Tinder and Hinge are racing ahead with bots, hiring cuts and new AI-only platforms, betting on algorithm-driven matchmaking despite user fears.
Vertu’s new Alphafold pairs a Hermes AI agent, capable of multi-step workflow automation, with a calfskin-wrapped, titanium-accented shell—yet its internal chassis mirrors the $1,100 ZTE Nubia Fold, raising questions about the true value of its luxury price tag.
The 2026 audit of MCP, A2A and ACP protocols uncovered 35 specification errors and 30 additional failures when chained, showing that a single compromised agent can silently leak data. Researchers recommend tamper-evident ledgers, least-privilege tokens, content labeling, cryptographic trace IDs, and
Claude Code는 원문 프롬프트가 API에 도달하는 즉시 토큰을 기록합니다. 따라서 MCP 클리닝 단계가 실행될 때는 이미 원문, 도구 호출, 그리고 클리닝된 버전이 모두 계산된 상태이므로, 비용이 세 배로 청구될 수 있습니다.
영상이 확산되면서 온라인상에서 의견이 엇갈렸습니다. 일부는 딥페이크의 오류를 포착한 반면, 다른 이들은 AI 조작 가능성만으로도 모든 영상의 신뢰성을 의심해야 한다고 주장하며 오늘날 탐지 기술의 사각지대를 드러냈습니다.
새로운 트레이닝 캠퍼스에서 Digit은 토트 박스 이동부터 트레일러 전체 하역까지 모든 과정을 연습할 수 있습니다. 이는 임시적인 현장 테스트를 반복 가능하고 처리량이 높은 파이프라인으로 전환하여, 소프트웨어 업데이트와 현장 배치 사이의 지연 시간을 획기적으로 단축할 수 있게 해줍니다.
칩 제조사들이 AI 데이터 센터용 고대역폭 메모리 생산에 웨이퍼 용량을 집중하면서, 보급형 스마트폰에 사용되는 표준 RAM 공급이 급감하고 있습니다. 이로 인한 비용 상승으로 인도의 저가형 스마트폰 가격이 최대 68%까지 치솟았으며, 그 결과 15,000루피 미만 제품의 출하량은 45% 감소했습니다.
이 시스템은 각 프롬프트를 지역 및 기기별로 7~8회 실행한 후 신뢰 구간을 계산하며, 이를 통해 ChatGPT, Claude, Gemini 등의 브랜드 언급이 질의마다 매우 불규칙하게 변한다는 사실을 밝혀냈습니다.