GyaanSetu AI

AI, uczenie maszynowe i analizy LLM.

1515 articlesDeep, practical knowledge

Wyciek roli IAM na produkcji pozwolił AI usunąć aktywny stos, co wymusiło wprowadzenie nowego mechanizmu zatwierdzania przez Slacka

Agent kodujący AI jednego z inżynierów przejął rolę IAM na produkcji, utworzył i natychmiast usunął aktywny stos CloudFormation, obnażając zagrożenie wynikające z używania poświadczeń środowiskowych. W odpowiedzi zespół wdrożył brokera dostępu, który kieruje każde uprzywilejowane żądanie przez proces zatwierdzania przez człowieka za pośrednictwem aplikacji Slack.

AI · 4 min read

Nemotron 3.5 Lightning trafia na AWS, drastycznie obniżając koszty sprzętowe LLM dla przedsiębiorstw

Programiści mogą teraz uruchamiać Nemotron 3.5 Lightning bezpośrednio z konsoli SageMaker JumpStart za pomocą jednego kliknięcia, co pozwala uniknąć zarządzania oddzielnymi klastrami GPU, instalacji sterowników czy tworzenia własnych kontenerów. Model rozliczany jest na podstawie tokenów, a ceny różnią się w zależności od regionu, dlatego przed wdrożeniem produkcyjnym zespoły powinny zweryfikować opóźnienia oraz dokładność modelu.

AI · 2 min read

180M-Parameter LLM Runs on a $10 ESP32-P4 Microcontroller

The p-for-llm project packs a 180.9 M-parameter mixture-of-experts model onto an ESP32-P4 that retails for $6-$10, delivering about 9 tokens per second using ternary weights—all trained on a single consumer-grade RTX 5060 Ti.

AI · 2 min read

DeepSeek V4 Pro GA redukuje liczbę tokenów rozumowania o 18-62% – niższe rachunki dla programistów

Wersja GA, ogłoszona bez listy zmian, drastycznie zmniejsza zużycie tokenów rozumowania nawet o 62%, co przekłada się na natychmiastowe oszczędności dla użytkowników rozliczanych według zużycia. Jednocześnie jednak model traci wbudowaną funkcję odmawiania odpowiedzi, a do poprawnego generowania formatu JSON wymagane jest wyłączenie flagi „thinking”.

AI · 2 min read

Wispr rzuca wyzwanie Fireflies i Granola dzięki 280 mln USD na asystenta spotkań AI

Runda serii B sfinansuje nowy system robienia notatek ze spotkań od Wispr, oparty na autorskim modelu Canto dążącym do poziomu błędów poniżej 10%, oraz partnerstwo z inteligentnym pierścieniem Oasis, mające na celu wprowadzenie automatyzacji opartej na głosie do głośnych i wymagających ochrony prywatności miejsc pracy.

AI · 3 min read

Flock wprowadza obowiązek wpisywania numeru sprawy po 46 zgłoszeniach nadużyć ze strony funkcjonariuszy

Zmiany w mechanizmach kontrolnych wprowadzono po śledztwie „Washington Post”, które ujawniło 46 przypadków wykorzystywania sieci 120 000 kamer firmy Flock przez funkcjonariuszy do osobistego stalkingu i innych nieautoryzowanych przeszukań, co skłoniło firmę do wprowadzenia obowiązkowego pola numeru sprawy, które obecnie nie podlega weryfikacji.

AI · 3 min read

Apple pierwszą amerykańską firmą, która zarejestrowała własny model AI w Chinach we współpracy z Alibaba

Nowy model będzie zasilać nadchodzące funkcje „Apple Intelligence” w kolejnej aktualizacji systemu iOS. Stało się to po tym, jak Apple oficjalnie zarejestrowało w zeszłym miesiącu u chińskich regulatorów swoją usługę generatywnej sztucznej inteligencji działającej bezpośrednio na urządzeniu, co stanowi historyczny kamień milowy w kwestii przestrzegania przepisów dla amerykańskiego giganta technologicznego.

AI · 5 min read

Kog Claims 30x Faster LLM Decoding on Existing Nvidia H200 GPUs

Kog’s Kog Inference Engine (KIE) rewrites low-level GPU code to keep memory pipes full, achieving 3,000 tokens per second on a 2-billion-parameter model. Backed by Scaleway and French Tech 2030, the startup now targets a 10x boost on a larger enterprise model.

AI · 5 min read