#AI
132 bài viết
Tokenizer Surgery: Cách build embedding model tiếng Thổ Nhĩ Kỳ mà không cần trai
Một cách tiếp cận cực kỳ thực dụng để adapt multilingual model sang ngôn ngữ ít tài nguyên không cần pretraining tốn kém, chỉ cần surgery tokenizer và offline distillation.
Lean 4 và bài toán verify toán tài chính bằng proof chính thức
Một thư viện Lean 4 mới cho phép formally verify các định lý toán tài chính nghe có vẻ hàn lâm nhưng implications của nó với fintech rất đáng bàn.

SonarQube Security: Bắt lỗi bảo mật trước khi lên production
SonarQube không chỉ check code quality nó còn là lớp bảo vệ đầu tiên chống lại SQL injection, XSS và hàng loạt lỗ hổng bảo mật nguy hiểm khác.
LVSA: Giải quyết bài toán video dài mà không cần retrain model
Sparse attention không cần training, giảm compute đến 3.33x, và còn fix được cái bug video bị lặp vòng mà VBench-Long không detect ra.
κ-SwiGLU: Khi MoE Router Tự Biết Mình Đang Confident Đến Đâu
κ-SwiGLU dùng chính router logits của MoE để điều chỉnh độ sắc nét của expert gate thêm cực ít params nhưng pretraining performance cải thiện rõ rệt.
TVIR: Khi AI biết tạo báo cáo có cả text lẫn hình ảnh
TVIR là benchmark và agent framework đầu tiên cho phép AI tạo ra báo cáo kết hợp text và visual một cách thông minh, không chỉ toàn chữ như trước.
SVI-Bench: Khi AI xem bóng đá nhưng không hiểu chiến thuật
Benchmark mới dùng thể thao để test xem AI có thực sự 'hiểu' video hay chỉ đang nhận diện hình ảnh đơn thuần.
FreeForm: Khi NVIDIA làm simulation vật lý nhanh hơn 100x
NVIDIA Research vừa công bố FreeForm một kỹ thuật simulation biến dạng vật thể real-time dựa trên particle skinning eigenmodes, nhanh hơn FEM truyền thống hàng trăm lần.
Harness-1: Khi RL agent học cách tìm kiếm thông minh hơn nhờ "giàn giáo" bên ngo
Harness-1 tách biệt việc ra quyết định tìm kiếm khỏi việc quản lý trạng thái và kết quả vượt trội hơn nhiều model lớn hơn đáng kể.
TELL: Khi AI detector biết giải thích tại sao, không chỉ phán xét
Thay vì chỉ trả về một con số, TELL chỉ ra đúng chỗ nào trong văn bản trông có vẻ do AI viết và tại sao.
MindZero: Dạy AI đọc suy nghĩ người dùng mà không cần label data
MindZero dùng self-supervised RL để train MLLM suy luận mental state của người dùng không cần annotation, inference nhanh hơn hẳn các phương pháp cũ.
Semantic Motion Anchors: Khi AI hiểu cả ý nghĩa đằng sau cử chỉ
Paper mới giải quyết vấn đề model cứ generate cử chỉ nhịp điệu nhàm chán thay vì hiểu ngữ nghĩa thực sự đằng sau lời nói.