GyaanSetu AI

Thông tin chuyên sâu về AI, học máy và LLM.

1515 articlesDeep, practical knowledge

Chip OLIX mới loại bỏ HBM đắt đỏ, hứa hẹn giảm chi phí điện năng cho các tác vụ AI

Vòng gọi vốn được dẫn dắt bởi Fundomo với sự tham gia của Arm, Hudson River Trading, quỹ Sovereign AI của Vương quốc Anh và đồng sáng lập Netflix Reed Hastings, trong khi Nick McKeown từ Stanford sẽ gia nhập hội đồng quản trị. OLIX dự kiến sẽ bắt đầu những đợt giao hàng đầu tiên vào nửa cuối năm 2027.

AI · 2 min read

Nghiên cứu từ UIUC cho thấy một nửa số câu trả lời chuẩn trong bộ thử nghiệm BIRD Text-to-SQL bị sai

Nhóm nghiên cứu từ Đại học Illinois Urbana-Champaign đã kiểm tra thủ công 238 trường hợp thất bại trong tập BIRD-dev và phát hiện ra rằng 52,8% trong số đó chứa lỗi chú thích — từ sai câu lệnh SQL đến các câu hỏi không đúng cấu trúc — đồng nghĩa với việc nhiều mô hình đang bị đánh giá thấp dù đưa ra các truy vấn chính xác.

AI · 3 min read

DeepSeek huy động 8 tỷ USD, nâng định giá lên 74 tỷ USD nhằm cạnh tranh với OpenAI và Google

Vòng gọi vốn 8 tỷ USD do NetEase, JD.com và IDG Capital dẫn đầu sẽ tài trợ cho việc mở rộng năng lực trung tâm dữ liệu, phát triển chip AI thế hệ mới và khả năng niêm yết trên sàn chứng khoán Trung Quốc, định vị DeepSeek như một "nhà vô địch quốc gia" trong cuộc chạy đua vũ trang AI.

AI · 3 min read

Mô hình Shieldstral 3B của Mistral AI đạt độ chính xác tương đương mô hình Guard 20B chỉ với một token

Shieldstral xử lý việc kiểm duyệt như một tác vụ hỏi đáp, cho phép cập nhật các chính sách thông qua prompt thay vì phải tái huấn luyện tốn kém, đồng thời trả về điểm xác suất từ 0-1 để các đội ngũ có thể tinh chỉnh ngưỡng cho việc tự động chặn, chuyển cho con người xem xét hoặc cho phép.

AI · 2 min read

Agent tự hành triển khai toàn bộ stack RAG chỉ trong 20 phút, sẵn sàng cho PR

Thông qua quy trình lặp 5 bước giữa người và agent, AI đã tự lập kế hoạch, nhận phê duyệt, xây dựng OpenSearch 3.7, LLM Ollama chạy cục bộ, các công cụ FastMCP cùng script Helm, sau đó mở luôn pull request—tất cả đều được thực hiện mà không cần đến một dòng code nào do con người viết.

AI · 3 min read

Trợ lý tặng quà bằng AI giúp tăng giá trị đơn hàng trung bình của Etsy

Các công cụ khám phá ứng dụng AI của Etsy đã chuyển đổi lượng truy cập dưới 1% từ ChatGPT thành những khách hàng có mức chi tiêu cao hơn, giúp nâng cao giá trị đơn hàng trung bình và thu hút thêm 350.000 người mua hoạt động trong quý 2—đánh dấu sự tăng trưởng số lượng người mua hoạt động đầu tiên kể từ năm 2023.

AI · 2 min read

Mô hình 4 tỷ tham số của ABSeeker vượt mặt các đối thủ lớn hơn nhờ cơ chế phân bổ tín dụng từng bước

Cơ chế Phân bổ Tín dụng Truy vết Câu trả lời (ABC) của ABSeeker định nghĩa lại phương pháp phân bổ tín dụng bằng cách chấm điểm từng hành động dựa trên các manh mối câu trả lời được trích xuất, giúp một mô hình 4 tỷ tham số có thể sánh ngang hoặc vượt qua các tác nhân lớn hơn nhiều trong các tác vụ đánh giá chuẩn.

AI · 4 min read

Astra của OpenAI tạo ra các chứng minh hình thức cho mười bài toán toán học kinh điển bằng Lean 4

Quy trình ba giai đoạn của Astra—tạo lập, trình bày và hình thức hóa—đưa mã Lean 4 vào một trình biên dịch, nơi trình biên dịch sẽ chấp nhận chứng minh hoặc trả về các lỗi để mô hình sửa lỗi lặp đi lặp lại, từ đó cung cấp một khuôn mẫu cụ thể cho việc lập luận được hỗ trợ bởi AI một cách đáng tin cậy.

AI · 3 min read

Hadrian Raises $1.4B, Hits $7.9B Valuation in Seven Months Amid Physical AI Boom

Unitree’s ¥150.80 per-share IPO values the Chinese quadruped maker at roughly ¥61 billion, while DeepSeek injects ¥140 million. Together with Hadrian’s $1.4 billion raise, the deals underscore a surge of investment into “physical AI,” even as China dominates humanoid patents and component costs thre

AI · 4 min read

OpenAI ngừng hỗ trợ ChatGPT Atlas vào ngày 9/8, buộc các nhà phát triển phải chuyển sang ứng dụng máy tính

OpenAI sẽ ngừng hoạt động của trợ lý trình duyệt Atlas vào ngày 9 tháng 8 năm 2026. Các nhà phát triển phải xuất dấu trang, sao lưu các trang đã lưu trong bộ nhớ đệm và cài đặt ứng dụng ChatGPT mới dành cho máy tính trên macOS hoặc Windows, nếu không sẽ có nguy cơ mất quyền truy cập vào quy trình làm việc và đối mặt với các lỗ hổng bảo mật chưa được khắc phục.

AI · 2 min read

Quá trình di chuyển OpenCode làm hỏng các quy tắc, công cụ và bộ nhớ của Claude Code – Đây là cách khắc phục

Thiết lập OpenCode của tác giả đã không thể tải các quy tắc, làm mất danh mục công cụ, bị mất phần front-matter của kỹ năng và mất khả năng ghi nhớ xuyên phiên làm việc. Bằng cách đổi tên CLAUDE.md thành AGENTS.md, xây dựng lại các kỹ năng chính và thêm quy tắc nhật ký phiên (session-log), quy trình làm việc có thể được khôi phục.

AI · 3 min read

Tòa án phán quyết Chatbot AI có thể ràng buộc các hãng hàng không – Air Canada phải chịu trách nhiệm pháp lý

Hội đồng phán quyết Air Canada phải chịu trách nhiệm về việc trình bày sai lệch do sơ suất sau khi chatbot dựa trên công nghệ RAG của hãng trích dẫn sai một điều khoản chính sách, coi câu trả lời của AI là một lời hứa có tính ràng buộc và yêu cầu hoàn trả một phần chi phí cho hành khách.

AI · 3 min read

eMAG chiếm lĩnh 80% các lựa chọn laptop do AI đề xuất, bỏ xa Altex

Một nghiên cứu về năm mô hình AI lớn cho thấy eMAG xuất hiện ở vị trí đầu tiên trong 80% các truy vấn về laptop tại Romania, trong khi Altex thường bị đẩy xuống vị trí thứ hai hoặc thứ ba – một vị trí có thể ảnh hưởng đáng kể đến tỷ lệ nhấp chuột.

AI · 3 min read

Atlassian Rovo cho phép kẻ tấn công đánh cắp các vé Jira và khóa API chỉ với một cú nhấp chuột

Lỗ hổng này cho phép kẻ tấn công nhúng các lệnh ẩn vào các trang Confluence hoặc tạo một liên kết khiến Rovo truy cập các URL tùy ý, từ đó gửi email nội bộ, tên không gian làm việc và các khóa API đến máy chủ của kẻ tấn công chỉ bằng một cú nhấp chuột của người dùng.

AI · 3 min read

Mô tả công cụ MCP làm cạn kiệt cửa sổ 8K token trên các LLM cục bộ 7B

Chỉ một máy chủ MCP duy nhất có thể chiếm trọn cửa sổ ngữ cảnh 8k token của một mô hình chạy trên thiết bị với 7 tỷ tham số, khiến không còn không gian cho đầu vào của người dùng và buộc các nhà phát triển phải lựa chọn giữa các thông số công cụ mơ hồ hoặc các cuộc hội thoại bị gián đoạn.

AI · 4 min read

NVIDIA Blackwell tiêu thụ 1 kW mỗi GPU, buộc các trung tâm dữ liệu phải chuyển sang làm mát bằng chất lỏng

Blackwell B200 tiêu thụ tới 1 kilowatt khi hoạt động hết công suất, đẩy giới hạn phân phối điện năng và khiến phương pháp làm mát bằng không khí truyền thống không còn đáp ứng được—các nhà cung cấp sẽ cần các vòng lặp làm mát bằng chất lỏng và khung máy mới để khai thác băng thông 130 TB/s của thiết bị.

AI · 2 min read