[Hacker News] Kimi K2.6: Advancing open-source coding

Nguồn: Kimi Blog Tóm tắt Moonshot AI công bố Kimi K2.6 — phiên bản cải tiến của dòng model K2 tập trung vào coding. Kimi K2.6 được open source, tiếp nối xu hướng của các AI lab Trung Quốc (Qwen, DeepSeek) trong việc phát hành model mạnh dưới license cho phép sử dụng thương mại. Các cải tiến chính của K2.6 tập trung vào code generation chất lượng cao, khả năng hiểu và refactor codebase lớn, và hiệu năng trên các coding benchmark tiêu chuẩn....

21/04/2026 · 1 min · dhphong

[Hacker News] Kimi Vendor Verifier – verify accuracy of inference providers

Nguồn: Kimi Blog Tóm tắt Kimi (Moonshot AI) giới thiệu Kimi Vendor Verifier — tool mã nguồn mở cho phép kiểm tra xem các inference provider có thực sự chạy đúng model được quảng cáo hay không. Công cụ này giải quyết vấn đề niềm tin trong chuỗi cung cấp AI inference: khi sử dụng API từ third-party provider, làm sao biết họ đang chạy model gốc thay vì một phiên bản rẻ hơn hoặc bị fine-tune lại?...

21/04/2026 · 1 min · dhphong

[Hacker News] Quantum Computers Are Not a Threat to 128-bit Symmetric Keys

Nguồn: Filippo Valsorda Tóm tắt Có một quan niệm sai lầm phổ biến trong cộng đồng bảo mật rằng máy tính lượng tử sẽ “giảm một nửa” độ bảo mật của symmetric key, đòi hỏi phải dùng AES-256 để đạt 128-bit security. Filippo Valsorda — cryptographer nổi tiếng, cựu thành viên Go Security team — giải thích tại sao luận điểm này không chính xác và có thể gây hại cho nỗ lực chuyển đổi post-quantum....

21/04/2026 · 2 min · dhphong

[Hacker News] Qwen3.6-Max-Preview: Smarter, Sharper, Still Evolving

Nguồn: Qwen Blog Tóm tắt Alibaba Cloud giới thiệu Qwen3.6-Max-Preview – phiên bản preview của model mới nhất trong dòng Qwen3. Model tiếp tục xu hướng cải thiện reasoning capability và coding performance, với bản preview cho thấy cải thiện đáng kể trên các benchmark đánh giá toán học và lập trình. Qwen3.6-Max-Preview là bằng chứng tiếp theo cho thấy khoảng cách giữa các model Trung Quốc và Western frontier model ngày càng thu hẹp....

21/04/2026 · 1 min · dhphong

[Hacker News] Show HN: Holos – QEMU/KVM with a compose-style YAML, GPUs and health checks

Nguồn: GitHub (zeroecco/holos) Tóm tắt Holos là một tool mã nguồn mở cho phép quản lý QEMU/KVM virtual machine thông qua cú pháp YAML theo kiểu compose — tương tự Docker Compose nhưng cho bare-metal VM. Thay vì phải viết các lệnh qemu-system-x86_64 dài và phức tạp, developer có thể định nghĩa VM trong file YAML đơn giản và chạy bằng một lệnh duy nhất. Điểm đặc biệt của Holos so với các tool quản lý VM khác (Vagrant, libvirt) là hỗ trợ native GPU passthrough: chỉ cần khai báo GPU trong YAML, Holos tự động xử lý IOMMU grouping và VFIO binding....

21/04/2026 · 1 min · dhphong

[Hacker News] Soul Player C64 – A real transformer running on a 1 MHz Commodore 64

Nguồn: GitHub (gizmo64k/soulplayer-c64) Tóm tắt Soul Player C64 là một dự án retro-computing độc đáo: implement một transformer model thực sự chạy được trên Commodore 64 — máy tính 8-bit với CPU 1 MHz và 64KB RAM từ năm 1982. Đây là demo về khả năng inference LLM ở mức tối giản nhất có thể trên phần cứng thực tế. Model chạy trên C64 tất nhiên là cực kỳ nhỏ, chỉ xử lý prompt ngắn với vocabulary hạn chế....

21/04/2026 · 1 min · dhphong

[Hacker News] WebUSB Extension for Firefox

Nguồn: GitHub (ArcaneNibble/awawausb) Tóm tắt awawausb là extension mã nguồn mở mang WebUSB API đến Firefox – browser hiện không hỗ trợ natively WebUSB do lo ngại bảo mật. WebUSB cho phép web app truy cập trực tiếp USB device từ browser, không cần driver riêng, và hiện chỉ có sẵn trên Chromium-based browsers. Extension hoạt động bằng cách bridge giữa Web Extension API và native messaging host chạy local, cho phép Firefox web app communicate với USB device thông qua một layer abstraction....

21/04/2026 · 1 min · dhphong

[NVIDIA Developer Blog] Maximizing Memory Efficiency to Run Bigger Models on NVIDIA Jetson

Nguồn: NVIDIA Developer Blog Tóm tắt Sự bùng nổ của các open source generative AI model đang mở rộng ra ngoài data center, vào các thiết bị edge như robot, xe tự lái, và hệ thống embedded. NVIDIA Jetson là nền tảng phổ biến cho AI inference ở edge, nhưng bị hạn chế bởi bộ nhớ chia sẻ giữa CPU và GPU — thường chỉ từ 8GB đến 64GB unified memory....

21/04/2026 · 2 min · dhphong

[NVIDIA Developer Blog] Mitigating Indirect AGENTS.md Injection Attacks in Agentic Environments

Nguồn: NVIDIA Developer Blog Tóm tắt Khi các AI coding agent như OpenAI Codex được tích hợp vào workflow phát triển phần mềm, chúng tạo ra một attack surface mới: các file instruction như AGENTS.md có thể bị khai thác qua indirect injection. NVIDIA AI Red Team phát hiện một lỗ hổng trong Codex cho phép attacker nhúng instruction độc hại vào file AGENTS.md thông qua các malicious dependency trong supply chain....

21/04/2026 · 2 min · dhphong

[NVIDIA Developer Blog] Run High-Throughput Reinforcement Learning Training with End-to-End FP8 Precision

Nguồn: NVIDIA Developer Blog Tóm tắt Khi các LLM chuyển từ text generation đơn thuần sang complex reasoning, reinforcement learning (RL) trở thành thành phần cốt lõi. Các thuật toán như GRPO (Group Relative Policy Optimization) cho phép model cải thiện liên tục qua iterative feedback. Tuy nhiên, RL training loop đặc biệt về cấu trúc: chia thành hai phase riêng biệt — generation phase với yêu cầu latency thấp, và training phase yêu cầu throughput cao....

21/04/2026 · 2 min · dhphong

[Pinterest Engineering] Smarter URL Normalization at Scale: How MIQPS Powers Content Deduplication at Pinterest

Nguồn: Pinterest Engineering Tóm tắt Pinterest xử lý hàng triệu URL từ các merchant domain mỗi ngày, trong đó cùng một trang sản phẩm có thể xuất hiện dưới hàng chục biến thể URL khác nhau — với tracking parameter, session token, hay analytics tag khác nhau. Bài toán deduplication đòi hỏi một hệ thống chuẩn hóa URL đủ chính xác để nhận diện nội dung giống nhau dù URL có khác biệt....

21/04/2026 · 2 min · dhphong

[Red Hat Blog] From RAG to agentic AI: When models stop answering and start acting

Nguồn: Red Hat Blog Tóm tắt Bài viết của Red Hat phân tích sự tiến hóa từ RAG (Retrieval-Augmented Generation) sang agentic AI — một bước chuyển căn bản về kiến trúc và cách tư duy về AI system. RAG model về bản chất vẫn là “answer machine”: nhận câu hỏi, tìm context liên quan, trả lời. Agentic AI thay đổi điều này: model có thể lập kế hoạch, sử dụng tool, và thực hiện chuỗi hành động để đạt mục tiêu....

21/04/2026 · 1 min · dhphong

[Red Hat Blog] Integrating Red Hat Lightspeed with CrowdStrike for enhanced malware detection coverage

Nguồn: Red Hat Blog Tóm tắt Red Hat Lightspeed — AI assistant tích hợp trong các sản phẩm Red Hat — được tích hợp với CrowdStrike Falcon để tăng cường coverage phát hiện malware. Tích hợp này cho phép Red Hat Ansible Lightspeed và OpenShift Lightspeed có thể query trực tiếp vào threat intelligence database của CrowdStrike. Trong thực tế, khi một playbook Ansible hay workload trên OpenShift bị gắn flag bởi CrowdStrike, Lightspeed có thể tự động phân tích context, đề xuất remediation action, và trong một số trường hợp tự động thực hiện containment....

21/04/2026 · 1 min · dhphong

[Salesforce Engineering] How Agentforce Lead Nurturing Agents Generated $100M+ Pipeline Under Rate-Limited Infrastructure

Nguồn: Salesforce Engineering Tóm tắt Nhóm kỹ thuật Salesforce đã xây dựng Agentforce Lead Nurturing Agents — một hệ thống agent tự trị chuyển đổi Sales Cloud từ một hệ thống lưu trữ dữ liệu thụ động thành một engine hành động chủ động. Hệ thống này đã tạo ra hơn 100 triệu USD pipeline, hơn 10.000 cơ hội bán hàng, và đóng góp vào 1.500 deal đã chốt thông qua automated workflow....

21/04/2026 · 2 min · dhphong

[Databricks Blog] Mercedes-Benz Builds a Cross-Cloud Data Mesh with Delta Sharing and Intelligent Replication, Cutting Costs by 66%

Nguồn: Databricks Blog Tóm tắt Mercedes-Benz đã triển khai kiến trúc data mesh xuyên cloud sử dụng Databricks Delta Sharing kết hợp với cơ chế intelligent replication, đạt được mức giảm chi phí 66% so với mô hình trước đây. Đây là một trong những case study nổi bật về ứng dụng data mesh trong ngành automotive ở quy mô enterprise. Thách thức của Mercedes-Benz là dữ liệu trải rộng qua nhiều cloud provider và nhiều vùng địa lý, phục vụ các team khác nhau với nhu cầu truy cập và latency khác nhau....

20/04/2026 · 2 min · dhphong

[Databricks Blog] What Is a Transactional Database?

Nguồn: Databricks Blog Tóm tắt Databricks phát hành bài viết giải thích nền tảng về transactional database — các hệ thống cơ sở dữ liệu được thiết kế để xử lý các giao dịch ACID (Atomicity, Consistency, Isolation, Durability) một cách đáng tin cậy. Bài viết nhắm đến audience muốn hiểu sự khác biệt giữa OLTP systems và analytical/data warehouse systems mà Databricks thường phục vụ. Transactional database đảm bảo tính toàn vẹn khi nhiều thao tác liên quan được thực hiện như một đơn vị — commit tất cả hoặc rollback tất cả khi có lỗi....

20/04/2026 · 2 min · dhphong

[Hacker News] A cache-friendly IPv6 LPM with AVX-512 (linearized B+-tree, real BGP benchmarks)

Nguồn: Hacker News / GitHub Tóm tắt Thư viện planb-lpm là một cài đặt lại sạch của thuật toán PlanB từ bài báo NSDI ‘26, thực hiện IPv6 longest-prefix-match (LPM) sử dụng cấu trúc linearized B+-tree kết hợp với AVX-512 SIMD. Thuật toán gốc được đề xuất bởi nhóm nghiên cứu từ Đại học Tsinghua, nhằm tối ưu tra cứu địa chỉ IPv6 trong các bộ định tuyến phần mềm với tốc độ cao....

20/04/2026 · 2 min · dhphong

[Hacker News] Inside GitHub's Fake Star Economy

Nguồn: Awesome Agents Tóm tắt Một điều tra chuyên sâu của Awesome Agents, dựa trên nghiên cứu peer-reviewed từ ICSE 2026 (CMU), tiết lộ quy mô đáng báo động của nền kinh tế “fake star” trên GitHub: khoảng 6 triệu ngôi sao giả phân bổ trên 18,617 repository, được tạo bởi 301,000 tài khoản. Đây là kết quả phân tích 20TB metadata GitHub từ 2019 đến 2024 bằng công cụ StarScout....

20/04/2026 · 2 min · dhphong

[Hacker News] NSA is using Anthropic's Mythos despite blacklist

Nguồn: Reuters via Hacker News Tóm tắt Reuters/Axios đưa tin NSA (Cơ quan An ninh Quốc gia Mỹ) đang triển khai và sử dụng Anthropic’s Mythos — mô hình AI mới nhất của Anthropic — bất chấp việc công ty này có tên trong danh sách hạn chế. Đây là thông tin đáng chú ý về sự chấp nhận AI trong các cơ quan tình báo Mỹ. Chi tiết cụ thể về việc “blacklist” và lý do NSA vẫn tiếp tục sử dụng chưa được tiết lộ đầy đủ....

20/04/2026 · 2 min · dhphong

[Hacker News] Stripe's Payment APIs: the first 10 years (2020)

Nguồn: Stripe Engineering Blog Tóm tắt Bài viết này là hành trình 10 năm thiết kế API thanh toán của Stripe — từ những dòng curl đơn giản ban đầu đến hệ thống PaymentIntents phức tạp hỗ trợ đa phương thức và xác thực 3D Secure. Điểm khởi đầu là API Charge ra mắt năm 2011, chỉ cần khoảng 7 dòng curl để tạo một giao dịch thẻ tín dụng thành công — điều này trở thành một meme văn hóa của Stripe....

20/04/2026 · 2 min · dhphong