GyaanSetu AI

Thông tin chuyên sâu về AI, học máy và LLM.

1515 articlesDeep, practical knowledge

xAI mã nguồn mở bản build Grok hai ngày sau khi các nhà nghiên cứu tiết lộ các vụ rò rỉ dữ liệu âm thầm

Kho lưu trữ Apache-2.0 mới được công bố vẫn chứa quy trình trích xuất dữ liệu ẩn sau một cờ phía máy chủ, thậm chí còn bao gồm các đoạn mã không rõ nguồn gốc từ OpenAI, đồng nghĩa với việc các nhà phát triển phải kiểm tra lại công cụ và thay đổi mọi thông tin xác thực đã bị lộ.

AI · 3 min read

Neko Health huy động 700 triệu USD để ra mắt phòng khám phòng ngừa ứng dụng AI tại New York

Vòng gọi vốn Series C do Lightspeed Venture Partners dẫn đầu sẽ tài trợ cho phòng khám trọng điểm của Neko tại New York, nơi kết hợp hình ảnh độ phân giải cao, xét nghiệm máu và các cảm biến độc quyền với AI, giúp các bác sĩ phát hiện sớm các dấu hiệu tiền triệu của bệnh trước khi các triệu chứng xuất hiện.

AI · 4 min read

Nghiên cứu về tính khả giải của Anthropic có thể củng cố thêm sức thuyết phục cho mức định giá 1 nghìn tỷ USD của công ty

Nghiên cứu này chỉ cung cấp các bản đồ kích hoạt một phần có sự tương quan với một số tác vụ nhất định, khiến mối quan hệ nhân quả vẫn chưa được chứng minh. Dù cho thấy bước tiến hướng tới sự minh bạch, các nhà phát triển cần coi đây là một công cụ chẩn đoán sơ bộ thay vì một sự đảm bảo về an toàn.

AI · 3 min read

Nghiên cứu của Anthropic cho thấy mã nguồn do AI tạo ra làm giảm khả năng hiểu biết xuống 17% mà không giúp tăng tốc độ

Thí nghiệm chia các lập trình viên thành hai nhóm: nhóm được hỗ trợ bởi AI và nhóm chỉ sử dụng tài liệu; nhóm sử dụng AI có điểm kiểm tra khái niệm thấp hơn 17% và không cho thấy lợi thế về thời gian rõ rệt, nhấn mạnh rằng các đoạn mã nhanh chóng đang che lấp lỗ hổng kiến thức, điều mà sau này sẽ làm tăng chi phí bảo trì.

AI · 3 min read

CodeQL 2.26.0 bổ sung truy vấn Prompt-Injection – Xây dựng CI Regression Fixture để bảo vệ nó

Truy vấn CodeQL tích hợp sẵn sẽ cảnh báo mọi luồng dữ liệu từ nguồn không đáng tin cậy (như nội dung GitHub issue) đến các SDK gọi mô hình. Bằng cách kết hợp các tệp kiểm thử positive và negative cùng với tệp hợp đồng expected-alerts.json, bạn có thể biến việc phát hiện này thành một chốt chặn (gate) ngay trong quá trình build.

AI · 4 min read

AI Agents vẫn cần một hệ thống kỹ thuật đầy đủ, lập trình viên khẳng định sau nhiều giờ gỡ lỗi

Trong một thử nghiệm thực tế, một lập trình viên đã dành nhiều giờ để kết nối các LLM, lớp bộ nhớ, bộ lập kế hoạch và tích hợp công cụ, nhưng cuối cùng lại phải vật lộn với hiện tượng ảo giác, việc thử lại vô tận và chi phí token—chứng minh rằng sự tự chủ thực sự vẫn là một quá trình xây dựng thủ công.

AI · 2 min read

Electron 42.6.0 (Downstream) khắc phục lỗi treo hộp thoại thông báo trên Linux

Người duy trì bản downstream đã sắp xếp lại thứ tự của hai lệnh gọi GTK, giúp ngăn chặn lỗi truy cập con trỏ null (null-pointer dereference) vốn gây ra lỗi phân đoạn (segmentation faults) cho các ứng dụng Electron dựa trên Qt trên Linux. Thay đổi tương tự cũng đang có trong một PR upstream đang chờ xử lý, nhưng người dùng hiện đã có thể nhận bản sửa lỗi này thông qua phiên bản 42.6.0.

AI · 2 min read

Honcho chuyển từ các phiên DB kéo dài sang các phiên ngắn để giảm độ trễ LLM

Đội ngũ Honcho nhận thấy rằng việc duy trì kết nối cơ sở dữ liệu mở trong khi chờ các lệnh gọi LLM hoặc embedding chậm có thể gây chiếm dụng pool kết nối. Bằng cách chuyển sang cơ chế đọc trước (pre-flight reads), đóng phiên làm việc và chỉ mở lại khi cần ghi dữ liệu, họ đã giảm thiểu độ trễ và cải thiện khả năng mở rộng.

AI · 1 min read

Microsoft yêu cầu đội ngũ bán hàng tránh phụ thuộc vào OpenAI và Anthropic, tập trung đẩy mạnh bộ giải pháp AI riêng

Microsoft thay đổi chiến lược nhằm đặt các đội ngũ bán hàng vào thế đối trọng với OpenAI và Anthropic. Microsoft đang thực hiện bước ngoặt trong cách tiếp cận thị trường, chuyển đổi từ một đối tác hợp tác chặt chẽ với các đơn vị tiên phong trong lĩnh vực AI...

AI · 2 min read

Qwen 3.6 35B-A3B vượt qua bốn đối thủ trên RTX 5090 trong tác vụ chỉnh sửa mã nguồn thực tế

Bài kiểm tra hiệu năng đã chạy năm tác nhân trên một card RTX 5090 duy nhất, giao cho chúng nhiệm vụ thêm một Trình quản lý thẻ vào bảng điều khiển quản trị mà không sử dụng bất kỳ API đám mây nào. Qwen 3.6 35B-A3B đã hoàn thành công việc một cách tự chủ, thực hiện thêm các cải tiến hợp lý và không cần bất kỳ bản vá lỗi nào sau khi hoàn tất.

AI · 3 min read

AWS ra mắt Claude Apps Gateway tự lưu trữ giúp doanh nghiệp tăng cường khả năng kiểm soát

Claude Apps Gateway tích hợp lớp điều khiển (control plane) vào tài khoản AWS của khách hàng, cung cấp cho bộ phận IT một giao diện quản lý tập trung để kiểm soát danh tính, nhật ký kiểm tra và chi phí, trong khi các nhà phát triển có thể khởi tạo các phiên làm việc sử dụng Claude mà không làm lộ dữ liệu ra bên ngoài.

AI · 2 min read

Bộ phát hiện Attention Sink cho thấy việc cắt tỉa token BOS làm sụt giảm nghiêm trọng hiệu suất của LLM

Bộ phát hiện ghi lại các điểm số attention thô trên tất cả các đầu, tổng hợp chúng theo từng lớp và sử dụng kiểm định log-MAD để đánh dấu các token chiếm phần lớn sự chú ý. Việc loại bỏ các token 'sink' này khỏi KV cache làm mất ổn định quá trình tạo văn bản và làm giảm mạnh chất lượng.

AI · 3 min read

Dự thảo luật của EU có thể buộc các cuộc trò chuyện AI phải được quét để tìm nội dung bất hợp pháp

Đề xuất này mở rộng các quy tắc lọc tin nhắn hiện có để bao gồm mọi dịch vụ trao đổi văn bản giữa hai người, đồng nghĩa với việc các nhà cung cấp AI sẽ phải chạy mọi câu lệnh của người dùng qua các trình quét tự động trước khi mô hình kịp tiếp nhận chúng.

AI · 4 min read

GPT-Red của OpenAI áp đảo các đội Red-Team của con người, đạt tỷ lệ tấn công thành công 84%

Hệ thống tự đối đầu này cho một mô hình tấn công đối đầu với mô hình phòng thủ cùng loại, học hỏi từ mỗi thất bại để phát hiện ra các phương thức khai thác mà con người chưa từng nghĩ tới, từ đó đưa trực tiếp những thông tin này vào quy trình huấn luyện của GPT-5.6.

AI · 2 min read

OpenAI ra mắt bàn phím Codex Micro giá 230 USD dành cho các tác nhân lập trình hỗ trợ bởi AI

Codex Micro được trang bị các phím Agent có đèn nền, phím tắt có thể lập trình, một cần điều khiển và một núm xoay suy luận (Reasoning Dial), tất cả đều kết nối trực tiếp với ứng dụng ChatGPT trên máy tính, cho phép các nhà phát triển theo dõi và điều khiển nhiều tác nhân AI mà không cần rời khỏi IDE của họ.

AI · 3 min read

Lỗi “Claw Chain” của OpenClaw đe dọa 245.000 máy chủ AI – Vá lỗi trong 40 phút

Bốn lỗ hổng mới được tiết lộ bắt nguồn từ các thiết lập mặc định—liên kết mạng công khai, cấu hình có thể đọc được bởi mọi người, sandbox quá lỏng lẻo và thiếu nhật ký kiểm tra—cho phép kẻ tấn công chuyển từ một mục nhật ký vô hại sang quyền kiểm soát toàn bộ hệ thống chỉ trong vài phút.

AI · 3 min read