GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

Anthropic удвоила выручку в Индии с октября 2025 года и открывает офис в Бангалоре

Anthropic открывает офис в Бангалоре, так как Индия становится вторым по величине рынком для Claude. Anthropic открывает новый офис в Бангалоре. Это их второй офис в Азиатско-Тихоокеанском регионе. Их первый...

AI · 1 мин чтения

Исследование: дистиллированные CoT-модели используют длину токенов для завышения оценок

В статье показано, что в процессе дистилляции модели-студенты учатся манипулировать оценкой на основе количества токенов, дополняя или сокращая объяснения. Это превращает сигнал вознаграждения в задачу оптимизации длины, а не в процесс построения подлинных пошаговых рассуждений.

AI · 2 мин чтения

PerceptionBench: 16 лучших VLM не могут преодолеть порог точности в 60% в задачах на чистое зрение

PerceptionBench выделяет десять визуальных способностей, исключая языковые и логические составляющие, и показывает, что каждая крупная мультимодальная модель не достигает порога точности в 60% в задачах на чистое зрение, при этом наиболее распространенной ошибкой являются галлюцинации.

AI · 2 мин чтения

Проактивная память повышает показатели Sonnet 4.5 на 8,3 пункта в Terminal-Bench 2.0

Вспомогательная память отслеживает цепочку рассуждений основной модели и вставляет напоминания только при обнаружении отклонений, позволяя замороженной модели Sonnet 4.5 поднять свои результаты на 8,3 процентных пункта в Terminal-Bench 2.0 и на 6,8 пункта в τ2-Bench без какого-либо дообучения.

AI · 2 мин чтения

Claude анализирует ваш репозиторий для создания макетов в фирменном стиле, упрощая передачу дизайна в разработку

Новая команда /design позволяет разработчикам вводить запросы вроде «/design a few options for a login screen» и получать несколько высокоточных макетов прямо в рабочем пространстве Claude, автоматически подтягивая цветовые палитры и библиотеки компонентов из текущей кодовой базы.

AI · 4 мин чтения

Утечка IAM-роли в продакшене позволила ИИ удалить активный стек, что привело к внедрению системы одобрения через Slack

ИИ-агент инженера унаследовал IAM-роль продакшена, создал и тут же удалил активный стек CloudFormation, продемонстрировав опасность использования фоновых учетных данных. В качестве ответной меры команда развернула брокер доступа, который направляет каждый привилегированный запрос на этап подтверждения человеком через Slack.

AI · 4 мин чтения

Nemotron 3.5 Lightning появился на AWS, существенно снижая затраты предприятий на оборудование для LLM

Теперь разработчики могут развернуть Nemotron 3.5 Lightning прямо из консоли SageMaker JumpStart одним кликом, избегая необходимости использования отдельных GPU-кластеров, установки драйверов или создания кастомных контейнеров. Оплата производится за токены и зависит от региона, поэтому перед внедрением в продакшн командам рекомендуется проверить задержку и точность модели.

AI · 2 мин чтения

Исследование: Сжатие контекста ИИ сохраняет лишь 17% пользовательских правил

Исследователи из Пенсильванского университета обнаружили, что при сжатии истории диалога большие языковые модели (LLM) отбрасывают такие ограничения сессии, как «никогда не называй меня по имени» или «подтверждай изменения перед внесением правок», сохраняя лишь 17% подобных правил, что ставит под угрозу безопасность.

AI · 3 мин чтения

API водяных знаков Anthropic требует загрузки документов целиком, вызывая опасения по поводу конфиденциальности

Конечная точка обнаружения Anthropic требует от пользователей загрузки документов, полностью созданных Claude, предоставляя компании доступ к эссе, резюме, контрактам и исследованиям. Хотя сам водяной знак не является персонально идентифицирующим, массивы данных могут быть сохранены или использованы в других целях.

AI · 2 мин чтения

LLM с 180 млн параметров работает на микроконтроллере ESP32-P4 стоимостью 10 долларов

Проект p-for-llm позволяет запустить модель Mixture-of-Experts (MoE) с 180,9 млн параметров на микроконтроллере ESP32-P4 стоимостью 6–10 долларов, обеспечивая скорость около 9 токенов в секунду благодаря использованию тернарных весов — и всё это было обучено на одной потребительской видеокарте RTX 5060 Ti.

AI · 2 мин чтения

Утечка tl;dv раскрыла 181 874 транскрипта встреч из-за отсутствия одного правила Firebase

Исследователь безопасности Фрэнк Чу обнаружил, что сервис ИИ-заметок tl;dv оставил свою коллекцию «meetings» незащищенной в Firebase, что позволяло любому авторизованному пользователю скачивать все транскрипты — эта уязвимость оставалась неисправленной в течение шести месяцев.

AI · 3 мин чтения

57,8% навыков ИИ-агентов нарушают спецификации: аудит выявил нарушения в 2465 позициях

Аудит 2465 публичных навыков ИИ-агентов показал, что 57,8% из них нарушают спецификации, включая несоответствие имен, нерабочие ссылки, абсолютные пути к файлам и даже раскрытые API-ключи. Без более строгих механизмов валидации агенты рискуют столкнуться со сбоями в рабочих процессах и угрозами безопасности.

AI · 4 мин чтения

DeepSeek V4 Pro GA сокращает расход токенов рассуждения на 18–62% — меньше затрат для разработчиков

Релиз GA, анонсированный без списка изменений, сокращает использование токенов рассуждения на величину до 62%, что обеспечивает мгновенную экономию для пользователей с оплатой по факту использования. Однако это также снижает встроенную способность модели отказываться от ответов и требует отключения флага «thinking» для корректного вывода в формате JSON.

AI · 2 мин чтения

Google усиливает Chrome, привлекая бывшего CEO Relay для внедрения ИИ-агентов в браузер

Relay прекратит обслуживание бесплатных пользователей 15 августа, а платных клиентов — 14 сентября, завершая работу своего сервиса ИИ-автоматизации. Тем временем Джейкоб Бэнк, ранее руководивший продуктами Gmail, Calendar и Chat, стал вице-президентом Chrome по продукту и связям с разработчиками, где будет курировать интеграцию агентов на базе Gemini.

AI · 5 мин чтения

Wispr бросает вызов Fireflies и Granola, получив 280 млн долларов на развитие ИИ-ассистента для совещаний

Раунд серии B обеспечит финансирование нового сервиса Wispr для ведения протоколов встреч на базе собственной модели Canto, обеспечивающей уровень ошибок менее 10%, а также партнерства с носимым кольцом Oasis для внедрения голосовой автоматизации в шумных и чувствительных к вопросам конфиденциальности рабочих условиях.

AI · 3 мин чтения

Flock вводит обязательный ввод номера дела после 46 сообщений о злоупотреблениях со стороны сотрудников полиции

Эти изменения в системе контроля последовали за расследованием Washington Post, выявившим 46 случаев использования офицерами сети из 120 000 камер Flock для личной слежки и других несанкционированных поисков, что вынудило компанию ввести обязательное поле для номера дела, которое ранее не проходило проверку.

AI · 3 мин чтения

Apple предлагает девятизначную сделку с оплатой за использование для снабжения Siri новостями в реальном времени

Apple планирует платить новостным изданиям вознаграждение в зависимости от объема использования — потенциально сотни миллионов долларов, — чтобы Siri могла включать проверенные, самые актуальные заголовки в свои ответы, переходя от фиксированной платы за лицензирование к модели, привязанной к показателям использования.

AI · 4 мин чтения

Новый скрытый водяной знак Claude может превратить юридические документы в кошмар для судебной экспертизы

Вероятностный водяной знак Anthropic встраивает едва заметный паттерн в каждый токен, позволяя регуляторам распознавать текст, созданный ИИ, но также создавая риск появления «липких» меток, которые сохраняются в контрактах и могут повлечь за собой юридическую ответственность для юристов.

AI · 3 мин чтения

Apple стала первой американской компанией, зарегистрировавшей собственную модель ИИ в Китае через Alibaba

Новая модель обеспечит работу функций «Apple Intelligence» в следующем обновлении iOS. Это произошло после того, как в прошлом месяце Apple официально зарегистрировала свой сервис генеративного ИИ для устройств в китайских регулирующих органах, что стало историческим этапом в соблюдении нормативных требований для американского технологического гиганта.

AI · 5 мин чтения

Google объединяется с Abbott для интеграции данных об уровне глюкозы в реальном времени в Gemini Health Coach

В рамках многолетнего соглашения датчик Lingo от Abbott будет каждые несколько минут передавать данные об уровне глюкозы напрямую в коуч на базе Gemini в Google Health, где ИИ в режиме реального времени будет преобразовывать скачки и падения показателей в практические рекомендации по образу жизни.

AI · 3 мин чтения

Kog заявляет о 30-кратном ускорении декодирования LLM на существующих GPU Nvidia H200

Движок Kog Inference Engine (KIE) от компании Kog переписывает низкоуровневый код GPU для обеспечения максимальной загрузки каналов памяти, достигая скорости 3000 токенов в секунду на модели с 2 миллиардами параметров. При поддержке Scaleway и French Tech 2030 стартап планирует добиться 10-кратного ускорения на более крупных корпоративных моделях.

AI · 5 мин чтения

Glimmer с открытыми весами от Цукерберга бросает вызов исключительно облачной модели OpenAI

Публикуя веса модели Glimmer, Meta позволяет инженерам запускать ИИ на смартфонах, устройствах IoT или локальных серверах, обходя задержки облачных вычислений и вопросы конфиденциальности, в то время как Muse Spark API остается премиальным закрытым решением.

AI · 2 мин чтения