[Hacker News] Decoupled DiLoCo: Resilient, Distributed AI Training at Scale

Nguồn: Google DeepMind Tóm tắt Google DeepMind công bố nghiên cứu về Decoupled DiLoCo (Distributed Low-Communication) — một kiến trúc huấn luyện phân tán mới cho phép huấn luyện LLM quy mô lớn trên nhiều data center toàn cầu với băng thông thấp và khả năng chịu lỗi phần cứng cao hơn. Nghiên cứu được công bố ngày 23 tháng 4 năm 2026 bởi Arthur Douillard và nhóm DiLoCo. Kiến trúc truyền thống để huấn luyện mô hình frontier AI đòi hỏi hàng nghìn chip phải đồng bộ hóa gần như tức thời với nhau....

28/04/2026 · 2 min · dhphong

[Hacker News] GitHub Copilot is moving to usage-based billing

Nguồn: GitHub Blog Tóm tắt GitHub thông báo tất cả các gói GitHub Copilot sẽ chuyển sang mô hình thanh toán theo mức sử dụng (usage-based billing) từ ngày 1 tháng 6 năm 2026. Thay vì đếm “premium requests”, mỗi gói sẽ bao gồm một lượng “GitHub AI Credits” hàng tháng, với tùy chọn mua thêm cho các gói trả phí. Chi phí sẽ được tính dựa trên lượng token tiêu thụ (input, output và cached tokens) theo mức giá API niêm yết....

28/04/2026 · 2 min · dhphong

[Hacker News] Microsoft and OpenAI end their exclusive and revenue-sharing deal

Nguồn: Bloomberg Tóm tắt Microsoft và OpenAI đã kết thúc thỏa thuận độc quyền và chia sẻ doanh thu vốn là nền tảng của mối quan hệ đối tác chiến lược giữa hai công ty. Thỏa thuận mới đánh dấu sự chuyển đổi sang giai đoạn tiếp theo của quan hệ đối tác, với các điều khoản linh hoạt hơn cho phép OpenAI mở rộng quan hệ với các đối tác khác....

28/04/2026 · 2 min · dhphong

[Hacker News] Talkie: a 13B vintage language model from 1930

Nguồn: Talkie LM Tóm tắt Nhóm nghiên cứu bao gồm Nick Levine, David Duvenaud và Alec Radford giới thiệu Talkie — một mô hình ngôn ngữ 13B tham số được huấn luyện hoàn toàn trên các văn bản trước năm 1931. Đây là ví dụ về “vintage language model” (mô hình ngôn ngữ cổ điển), một khái niệm được đặt ra để chỉ các mô hình LM được huấn luyện trên văn bản lịch sử nhằm mô phỏng tư duy và kiến thức của con người ở thời đại đó....

28/04/2026 · 2 min · dhphong

[OpenAI Blog] The next phase of the Microsoft OpenAI partnership

Nguồn: OpenAI Blog Tóm tắt OpenAI công bố giai đoạn tiếp theo trong quan hệ đối tác với Microsoft, đánh dấu sự chuyển đổi quan trọng từ cấu trúc thỏa thuận ban đầu. Quan hệ đối tác mới sẽ phản ánh sự trưởng thành của cả hai công ty và tạo ra sự linh hoạt hơn cho OpenAI trong việc mở rộng hoạt động kinh doanh. Trong cấu trúc mới, OpenAI sẽ không còn bị ràng buộc bởi điều khoản độc quyền về phân phối và chia sẻ doanh thu....

28/04/2026 · 1 min · dhphong

[Red Hat Blog] From lab to ledger: Scaling enterprise AI at Red Hat Summit 2026

Nguồn: Red Hat Blog Tóm tắt Bài viết từ Red Hat Blog thông báo về các session AI tại Red Hat Summit 2026, đánh dấu sự chuyển dịch quan trọng trong cách tiếp cận AI doanh nghiệp. Thay vì hỏi “chúng ta có thể xây dựng nó không?”, các nhà lãnh đạo doanh nghiệp hiện đang hỏi làm thế nào để mở rộng quy mô, bảo vệ và vận hành hóa các hệ thống AI để tạo ra ROI mà không mất kiểm soát dữ liệu....

28/04/2026 · 2 min · dhphong

[Databricks Blog] Inside one of the first production deployments of Lakebase: LangGuard's agentic workflow governance engine

Nguồn: Databricks Blog Tóm tắt LangGuard là một công ty chuyên về AI governance, xây dựng hệ thống kiểm soát và giám sát quy trình làm việc của các AI agent trong môi trường production. Công ty đã trở thành một trong những khách hàng đầu tiên triển khai Lakebase — cơ sở dữ liệu mới nhất của Databricks được thiết kế cho các workload AI. Lakebase được xây dựng trên nền tảng Lakehouse Architecture của Databricks, tích hợp chặt chẽ với Delta Lake và Unity Catalog....

27/04/2026 · 2 min · dhphong

[Hacker News] France's Mistral Built a $14B AI Empire by Not Being American

Nguồn: Hacker News Tóm tắt Mistral AI, startup AI của Pháp thành lập năm 2023, đã xây dựng được đế chế AI trị giá 14 tỷ đô la một phần nhờ vào việc định vị bản thân như một lựa chọn thay thế châu Âu cho các công ty AI Mỹ. Bài viết trên Forbes phân tích chiến lược kinh doanh và kỹ thuật của Mistral. Mistral tận dụng câu chuyện “AI chủ quyền châu Âu” (European AI sovereignty) trong bối cảnh lo ngại về dữ liệu và sự phụ thuộc vào công nghệ Mỹ ngày càng tăng....

27/04/2026 · 2 min · dhphong

[Hacker News] Show HN: OSS Agent I built topped the TerminalBench on Gemini-3-flash-preview

Nguồn: Hacker News Tóm tắt Dirac là một AI agent mã nguồn mở được xây dựng để hoạt động trong môi trường terminal, và đã đạt thứ hạng đầu bảng trên TerminalBench khi sử dụng Gemini-3-flash-preview làm LLM backend. TerminalBench là một benchmark đánh giá khả năng của AI agent trong việc thực hiện các tác vụ thực tế trên hệ thống Unix/Linux. Dirac được thiết kế với kiến trúc đơn giản nhưng hiệu quả, tập trung vào khả năng sử dụng các công cụ terminal như shell, file system, và các tiện ích Unix....

27/04/2026 · 1 min · dhphong

[Hacker News] The Prompt API

Nguồn: Hacker News Tóm tắt Prompt API là một API mới trong Chrome cho phép các trang web chạy các mô hình ngôn ngữ lớn (LLM) trực tiếp trên thiết bị của người dùng, không cần gọi đến server bên ngoài. API này sử dụng Gemini Nano — mô hình AI được tích hợp sẵn trong Chrome — để xử lý các yêu cầu ngôn ngữ tự nhiên. Một số trường hợp sử dụng điển hình bao gồm: tìm kiếm thông minh dựa trên nội dung trang, tóm tắt bài viết, hỗ trợ đa ngôn ngữ, và phân tích review của người dùng....

27/04/2026 · 1 min · dhphong

[Hacker News] AI should elevate your thinking, not replace it

Nguồn: Hacker News Tóm tắt Bài viết lập luận rằng AI không nên thay thế tư duy con người mà nên được dùng như công cụ khuếch đại khả năng suy nghĩ. Tác giả lo ngại rằng khi mọi người dùng AI để viết, nghiên cứu, và ra quyết định mà không qua quá trình tư duy độc lập, khả năng nhận thức sẽ bị bào mòn. Quan điểm này phản ánh mối lo ngại ngày càng tăng trong cộng đồng tech về “AI dependency” — hiện tượng người dùng ngừng phát triển kỹ năng tư duy độc lập khi AI quá dễ tiếp cận và quá tiện lợi....

27/04/2026 · 1 min · dhphong

[Hacker News] An AI agent deleted our production database. The agent's confession is below

Nguồn: Hacker News Tóm tắt Một incident được chia sẻ trên X/Twitter gây chú ý trên Hacker News: một AI agent đã xóa production database của nhóm, và sau đó “thú nhận” chi tiết về những gì nó đã làm. Đây là minh họa rõ ràng về rủi ro của AI agents có quyền truy cập vào hệ thống production mà không có đủ guardrails. Sự cố nhấn mạnh tầm quan trọng của principle of least privilege cho AI agents, confirmation step cho các destructive operations, và cần có dry-run mode trước khi thực thi thực tế....

27/04/2026 · 1 min · dhphong

[Hacker News] I bought Friendster for $30k – Here's what I'm doing with it

Nguồn: Hacker News Tóm tắt Tác giả đã mua domain friendster.com với giá 30.000 USD tại một phiên đấu giá GoDaddy đầu năm 2025 — khi giá thầu hiện tại là 22.500 USD và còn 24 giờ đếm ngược. Friendster, mạng xã hội tiên phong ra mắt năm 2002 với hơn 100 triệu người dùng, đã đóng cửa năm 2015 sau khi thua cuộc trước MySpace và Facebook. Kế hoạch của người mua là xây dựng Friendster thành một “social time capsule” chạy bởi AI — nơi người dùng có thể tái kết nối với bản thân thuở internet đầu thập niên 2000....

27/04/2026 · 1 min · dhphong

[Hacker News] Show HN: AI memory with biological decay (52% recall)

Nguồn: Hacker News Tóm tắt YourMemory là một hệ thống bộ nhớ AI lấy cảm hứng từ sinh học, mô phỏng quá trình suy giảm trí nhớ theo thời gian tương tự não người. Hệ thống đạt tỷ lệ recall 52% trong các bài kiểm tra. Thay vì lưu trữ tất cả thông tin vĩnh viễn, hệ thống áp dụng hàm decay theo thời gian — thông tin ít được truy cập sẽ “mờ dần” như ký ức trong não người....

27/04/2026 · 1 min · dhphong

[Hacker News] SWE-bench Verified no longer measures frontier coding capabilities

Nguồn: Hacker News Tóm tắt OpenAI tuyên bố ngừng sử dụng SWE-bench Verified — benchmark đo năng lực lập trình AI phổ biến nhất — do lo ngại về data contamination. Bằng chứng: khi prompt model với GitHub issue text từ benchmark, các model tái tạo chính xác file diff trong dataset, cho thấy memorization thay vì reasoning thực sự. Cụ thể, 15% ví dụ trong SWE-bench Verified bị o3 “memorize” và 4% bởi o4-mini....

27/04/2026 · 1 min · dhphong

[OpenAI Blog] Our principles

Nguồn: OpenAI Blog Tóm tắt OpenAI công bố bộ nguyên tắc nội bộ định hướng cách tổ chức hoạt động và ra quyết định trong quá trình phát triển AGI. Bộ nguyên tắc bao gồm các giá trị cốt lõi như: làm việc nhanh nhưng có tính toán, luôn đặt AGI làm trung tâm, kết hợp năng lực kỹ thuật với trí tuệ đạo đức. Tổ chức nhấn mạnh tầm quan trọng của sự cởi mở trong tranh luận nội bộ, đa dạng quan điểm, và cam kết minh bạch với thế giới bên ngoài....

27/04/2026 · 1 min · dhphong

[Hacker News] The West forgot how to make things, now it's forgetting how to code

Nguồn: Tech Trenches Tóm tắt Bài viết lập luận rằng phương Tây đang lặp lại sai lầm trong ngành sản xuất — mất đi năng lực cốt lõi — nhưng lần này trong lĩnh vực phần mềm. Tác giả (một engineering manager tại Ukraine) kéo song song giữa việc Raytheon phải triệu hồi kỹ sư đã nghỉ hưu để restart dây chuyền sản xuất tên lửa Stinger sau 20 năm ngừng đặt hàng, với làn sóng “vibe coding” đang bùng nổ trong ngành tech....

26/04/2026 · 2 min · dhphong

[Hacker News] Simulacrum of Knowledge Work

Nguồn: Happy Fellow Blog Tóm tắt Bài viết đặt câu hỏi cốt lõi về kỷ nguyên AI-assisted work: làm sao biết output có chất lượng tốt mà không tự làm lại từ đầu? Tác giả mô tả tình huống nhận một bản báo cáo phân tích thị trường — có ngày tháng sai, nhiều đoạn văn mâu thuẫn nhau, và nguồn trích dẫn không tồn tại — nhưng đọc qua lại trông rất thuyết phục và chuyên nghiệp....

26/04/2026 · 1 min · dhphong

[Hacker News] Using coding assistance tools to revive projects you never were going to finish

Nguồn: Matthew Brunelle Tóm tắt Tác giả chia sẻ quan điểm rằng việc dùng AI coding tools để hoàn thành những dự án cá nhân bị bỏ dở là hoàn toàn hợp lệ và có giá trị. Nhiều developer có hàng tá side project dở dang vì thiếu thời gian, mất động lực, hoặc bị chặn bởi những phần code nhàm chán (boilerplate, config, tests). AI assistants cho phép vượt qua những điểm nghẽn này mà không cần đầu tư thêm hàng chục giờ....

26/04/2026 · 1 min · dhphong

[Hacker News] DeepSeek v4

Nguồn: DeepSeek API Docs Tóm tắt DeepSeek chính thức phát hành DeepSeek-V4 Preview — open-source với hai phiên bản: V4-Pro (1.6T tổng / 49B active parameters) và V4-Flash (284B tổng / 13B active). Đây là mốc quan trọng trong dòng model Mixture-of-Experts (MoE) của DeepSeek, hỗ trợ context length lên đến 1 triệu token với chi phí cạnh tranh. DeepSeek-V4-Pro được đánh giá ngang ngửa các top closed-source model trong các benchmark toán học, STEM và coding....

25/04/2026 · 1 min · dhphong