Bảng AI

Bảng AI

Các bài viết về trí tuệ nhân tạo, công cụ mới, chính sách, hạ tầng và thực hành sử dụng AI.

Bản tin AI hằng tuần ngày 22 tháng 5 năm 2026

Author
김경진
Date
2026-05-23 09:49
Views
65

Bản tin AI hằng tuần ngày 22 tháng 5 năm 2026

Kênh Left Selector | 36 chủ đề · Sắp xếp mức độ quan trọng theo danh mục

"Harness mạnh hơn mô hình — một câu quan trọng nhất trong tuần này"

① Quản trị·đầu tư  |  ② Tiến bộ công nghệ  |  ③ Trường hợp sử dụng mới  |  ④ Hạ tầng·kiến trúc  |  ⑤ Pháp luật·chính sách  |  ⑥ Công nghiệp·việc làm

① Xu hướng quản trị·đầu tư

Anthropic huy động khoản đầu tư AI tư nhân lớn nhất từ trước đến nay

Định giá doanh nghiệp 900 tỷ USD, số tiền đầu tư 30 tỷ USD. Đây là vòng gọi vốn lớn nhất trong lịch sử các công ty AI tư nhân. So với Nvidia 5 nghìn tỷ USD và Alphabet 4,8 nghìn tỷ USD, Anthropic đang nhanh chóng bước vào địa hạt của các gã khổng lồ. Điểm đáng chú ý hơn là đây là vòng gọi vốn tư nhân, không phải IPO.

Andrej Karpathy gia nhập Anthropic

Đó là một lần chuyển việc của một cá nhân, nhưng trọng lượng khác hẳn. Đồng sáng lập OpenAI, người phụ trách AI tại Tesla, quay lại rồi rời đi để khởi nghiệp độc lập, và giờ là Anthropic. Nhân vật được xem là bậc thầy xây dựng pipeline huấn luyện gia nhập với vai trò phụ trách huấn luyện. Quyết định này có ý nghĩa chiến lược với cả Anthropic và Karpathy.

Elon Musk thua kiện OpenAI — đường IPO đã mở

Tòa án bác yêu cầu của Musk vì đã hết thời hiệu. Rào cản IPO của OpenAI biến mất, và việc niêm yết sớm nhất vào tháng 9 đang được nhắc đến. Trong khi đó, SpaceX cũng đã nộp hồ sơ IPO và có khả năng cao niêm yết trên Nasdaq vào giữa tháng 6. Nếu dự báo này thành hiện thực, Musk sẽ trở thành người nghìn tỷ đầu tiên trên thế giới.

Recursive Intelligence — thiết kế chip bằng AI, huy động 335 triệu USD

Đây là startup do hai cựu nhà nghiên cứu của Google Brain và Anthropic sáng lập. Mục tiêu là làm cho quy trình thiết kế chip nhanh hơn 100.000 lần. Hiện nay, thiết kế một con chip mới mất từ vài tuần đến vài tháng. Nếu rào cản này sụp đổ, chip chuyên dụng theo đơn đặt hàng sẽ xuất hiện hàng loạt. Đã có cách ví von với vụ bùng nổ sự sống kỷ Cambri 500 triệu năm trước. Đó là thế giới nơi hàng nghìn loại chip chuyên biệt xuất hiện cùng lúc.

"Một prompt mỏng không phải là một doanh nghiệp"

Hầu hết các startup chỉ đặt một prompt lên trên mô hình đã biến mất. Lý do là các công ty AI lớn bắt đầu cung cấp chức năng đó như tính năng mặc định. Hào lũy thật không phải là prompt. Đó là kinh nghiệm, niềm tin và dữ liệu. Lựa chọn khôn ngoan trong thời kỳ này là đóng gói tri thức và kinh nghiệm riêng thành khóa học, bản tin, công cụ, framework, rồi tạo ra cấu trúc vẫn vận hành ngay cả khi mình vắng mặt.

② Tiến bộ công nghệ

Luận điểm cốt lõi — harness thắng mô hình

Microsoft đặt harness riêng của mình, MDASH, lên một mô hình công khai đa dụng và vượt qua mô hình bí mật mà Anthropic chưa công bố trên benchmark. Không phải "mô hình mạnh đến đâu" mà là "đã cấu thành harness nào" quyết định hiệu năng trong thực chiến. MDASH là viết tắt của Multimodal Agentic Scanning Harness, một kiến trúc chuyên cho an ninh mạng. Nó đạt hạng nhất CyberGym benchmark mà không cần mô hình độc quyền.

Qwen 3.7 Max — tự chủ hoàn toàn 35 giờ, 1.000 lần gọi công cụ

Qwen 3.7 Max của Alibaba đã hoàn tất công việc tối ưu hóa kernel mà không có con người can thiệp, với 35 giờ liên tục và hơn 1.000 lần gọi công cụ. Đây là kỷ lục thế giới hiện tại. Mô hình này nằm trong nhóm đầu ở các benchmark suy luận và lập trình, có context 1 triệu token, output 65.000 token, hỗ trợ 48 ngôn ngữ và rẻ hơn nhiều so với các mô hình Mỹ. Đây là mô hình cần chú ý trong các tác vụ agentic nhiều bước.

Thinking Machines Lab — mô hình đối thoại thời gian thực hoàn toàn

Đây là mô hình đầu tiên của Thinking Machines Lab, do cựu CTO OpenAI Mira Murati sáng lập. Nó hiện thực hóa đối thoại thời gian thực hoàn toàn hai chiều, full duplex, không độ trễ. TML Interaction Small có cấu trúc mixture-of-experts với 276 tỷ tham số, kết hợp module tương tác thời gian thực và module suy luận ở bên trong. Bản research preview giới hạn sẽ sớm được công bố.

Sự tiến hóa độ chính xác của LLM — từ FP16 đến FP4

Ở giai đoạn đầu của ChatGPT, tháng 11 năm 2022, chuẩn là FP16. Sau các phương thức hỗn hợp FP8, đến năm 2026, 8-bit đã trở thành chuẩn sản xuất. Hiện nay xu hướng đang chuyển sang 4-bit và dự kiến trở thành chuẩn trong năm tới. Nghiên cứu áp dụng FP4 cho cả huấn luyện và suy luận cũng đang diễn ra. Số bit càng giảm thì cùng một phần cứng có thể chạy mô hình mạnh hơn.

Zero — ngôn ngữ lập trình dành cho AI

Đây là ngôn ngữ biên dịch do Chris State của Vercel Labs công bố. Có thể xem như một Rust mini. Nó nhanh và nhẹ. Khác biệt quyết định so với Rust là định dạng phản hồi lỗi. Zero luôn chỉ trả lời bằng JSON. Vì output của compiler là JSON có cấu trúc, AI đọc và xử lý dễ hơn nhiều. Mã chẩn đoán ổn định, output kế hoạch cố định. Đây là ngôn ngữ được thiết kế với tiền đề cộng tác cùng AI.

CLAUDE.md của Karpathy — công khai mã nguồn mở

Karpathy công khai CLAUDE.md của mình trên GitHub và trở thành chủ đề được chú ý. Có năm nguyên tắc. Nghĩ trước khi viết code, ưu tiên sự giản dị, thay đổi như phẫu thuật, tức chỉ sửa phần cần thiết, thực thi theo mục tiêu, viết test trước. Nếu muốn tạo CLAUDE.md của riêng mình, hãy chọn template theo vai trò, tạo thư mục nội dung về bản thân rồi yêu cầu Claude sinh ra. Khi thêm lệnh khởi đầu và smoke test cho workflow, Claude sẽ hiểu công việc của mình.

Grok 4.3 ra mắt — tháng 4 năm 2026, chỉ cho người trả phí

Grok 4.3 của xAI được phát hành trong tháng 4, giới hạn cho thuê bao trả phí. Sản phẩm được quảng bá là hỗ trợ cả phản hồi nhanh lẫn phân tích văn bản dài nhiều tệp ở chiều sâu. Cảm nhận của chính người trình bày khá thẳng thắn. Ông đăng ký gói 30 USD, thất vọng rồi hủy. Lý do là phần lớn thời gian ông dùng Claude và Claude tốt hơn nhiều.

③ Trường hợp sử dụng mới

Google I/O 2026 — tổng hợp các công bố chính

Đó là một hội nghị lớn kéo dài hai ngày. Chỉ ghi lại các điểm cốt lõi.

Gemini 3.5 Flash — hiện được chỉ định làm mô hình mặc định. Hiệu năng ngang Gemini 3.1 Pro nhưng rẻ hơn nhiều. 300 token mỗi giây, context 1 triệu token, output 64K, có thể điều chỉnh độ sâu suy nghĩ. Pro dự kiến ra mắt tháng tới.
Gemini Spark — agent cá nhân phiên bản Google. Chạy thường trực 24 giờ trên cloud, truy cập Gmail·Docs·Slides ngay sau khi đăng ký để xử lý công việc. Cần thuê bao trả phí.
AntiGravity — IDE ưu tiên agent, tái sinh sau thương vụ mua lại Windsurf.
AI Search chuyển thành agent — công bố chức năng thiết lập công việc 24 giờ. Chưa vận hành đầy đủ, nhưng hướng đi đã rõ.
Universal Commerce Protocol + Agent Payments Protocol — agent trực tiếp dùng hạ tầng thanh toán dựa trên Google Pay. Đây có thể trở thành bước ngoặt agent hóa cho kinh doanh trực tuyến.
Điều chỉnh giá — gói Ultra giảm từ 250 USD xuống 200 USD, mở gói Ultra mới 100 USD. Cấu trúc đã giống gói Anthropic Max, 100 và 200 USD.

Cố vấn tài chính cá nhân ChatGPT, liên kết Plaid

OpenAI đã liên kết ChatGPT với nền tảng thanh toán tài chính Plaid. Khi kết nối tài khoản ngân hàng, ChatGPT tạo báo cáo phân tích tài chính, dashboard và đưa ra lời khuyên. Việc thực hiện giao dịch trực tiếp chưa có, nhưng hướng đi tới cố vấn tài chính AI đã rõ.

Tencent Marvis + MiniMax Mavis — agent AI cá nhân từ Trung Quốc

Tencent có Marvis, một trợ lý AI cá nhân hoạt động thường trực 24 giờ, đã công bố bản beta cho Windows và Android. Nó hỗ trợ nhiều LLM.

MiniMax có Mavis với cấu trúc độc đáo. Ba loại agent, gồm leader, worker và verifier, cùng cộng tác. Worker và verifier duy trì quan hệ đối kháng và liên tục kiểm chứng kết quả. Đây là thiết kế loại bỏ hallucination trong công việc doanh nghiệp. Nó cũng hỗ trợ liên kết WeChat.

Claude + Obsidian + OMI — hệ sinh thái tri thức AI đeo được

OMI là máy ghi âm AI đeo trên cổ. Obsidian là cấu trúc thư mục của các tệp markdown, trong đó các tệp được nối với nhau bằng liên kết. Khi thêm tệp bằng kéo thả, tệp MD được tạo tự động. Cấu trúc này được dùng như kho nhớ và knowledge base, còn Claude sắp xếp và tái cấu trúc bối cảnh mà OMI thu thập. Đây là hệ sinh thái tri thức cá nhân nơi AI ghi lại và tư vấn cho toàn bộ đời sống.

Google AI Pointer — chuột trở thành mắt của AI

Khi đưa chuột lên một thành phần cụ thể trên màn hình, AI nhận biết vị trí chuột và thực thi lệnh tóm tắt, chỉnh sửa hoặc xử lý mục đó. Không cần nhập văn bản. Đây là giao diện gần với đổi mới UX.

Krea 2 — tạo hình ảnh bằng cách dùng hình ảnh dẫn hướng AI

Phiên bản mới của startup Krea tại San Francisco. AI được dẫn hướng không chỉ bằng văn bản mà cả bằng hình ảnh. Nó bao gồm tạo hình ảnh độ phân giải cao dựa trên moodboard và style reference, kết quả trong vòng 15 giây, live sketch trên canvas thời gian thực, và chức năng nâng độ phân giải 22K.

Bạn đồng hành AI — cứu rỗi cho cá nhân, chất độc cho xã hội?

Với người cao tuổi cô độc, AI có thể trở thành bạn đồng hành thực chất. Hiệu quả là có thật. Vấn đề nằm ở quy mô toàn xã hội. Con người đang mất dần cách trò chuyện với nhau. Bạn đồng hành AI quá dễ chịu. Quan hệ con người cần nỗ lực, kiên nhẫn và thời gian. AI không đòi hỏi gì. Nó là sự an ủi cho cá nhân, nhưng nghịch lý là sự thoải mái ấy có thể làm cô lập xã hội sâu hơn.

④ Hạ tầng·kiến trúc agent

Codex vs. Claude Code — phối hợp mới là đáp án

Gần đây, cấu trúc một agent gọi đồng thời Codex và Claude Code đang tăng lên. Codex có hiệu quả token cao hơn khoảng 4 lần trong một số tác vụ. Claude Code mạnh ở công việc production trên codebase hiện hữu quy mô lớn. Phối hợp điểm mạnh của từng bên là dòng chảy thực chiến hiện nay.

Hermes vs. OpenClaude — cuộc cạnh tranh agent tự cải tiến

OpenClaude có 374.000 sao GitHub, Hermes có 163.000. Tuy vậy, tốc độ tăng trưởng của Hermes nhanh. Điểm khác biệt của Hermes là tự cải tiến. Giữa các công việc, nó nhìn lại lịch sử, tạo skill mới và cải thiện skill hiện có. Giờ OpenClaude cũng đã đưa chức năng tương tự vào. Thuật ngữ trong ngành là "dreaming".

Thông tin phụ đáng chú ý. Đội ngũ của Peter Steinberger, nhà sáng lập OpenClaude, đã vận hành 100 agent lập trình tự chủ dựa trên GPT-5.5 trong một tháng và tiêu thụ 1,3 triệu USD tín dụng OpenAI API. Phần lớn chi phí là Fast Mode, và ông cho biết nếu là chế độ thường thì có lẽ ở mức 300.000 USD.

RAG vs. RAE — và 13 cách RAG không cần vector DB

RAG, Retrieval-Augmented Generation, biến câu hỏi thành vector, tìm thông tin tương tự rồi trả lời. RAE, Retrieval-Augmented Execution, đi thêm một bước. Nó không tìm câu trả lời mà tìm công cụ hoặc skill rồi thực thi hành động thực tế.

Có một lời khuyên thực dụng quan trọng. Khi nghe từ RAG, hãy bỏ quán tính tự động nghĩ đến vector DB. Có 13 phương án thay thế như tìm kiếm keyword, SQL, LLM-as-compiler theo cách Karpathy, Obsidian BM25, ELITE, tức khám phá văn bản lặp lại không dùng embedding. Nếu lượng dữ liệu nhỏ, cách nạp toàn bộ vào context là cách gọn và hiệu quả nhất.

Sandboxing agent + Docker — cô lập và bảo mật

Đây là kỹ thuật chạy agent AI trong môi trường cách ly để bảo vệ host. Chuẩn hiện tại là microVM như Firecracker. Nó có thể cô lập ở cấp phần cứng và khởi động trong khoảng 0,1 giây. Các lựa chọn nhẹ hơn gồm gVisor, V8 Isolate và runtime WebAssembly. Nguyên tắc bảo mật cốt lõi là cấp quyền tối thiểu, giới hạn nghiêm ngặt mạng outbound, tuyệt đối không mount SSH key hoặc profile trình duyệt.

Docker là công nghệ container bắt đầu tại Google năm 2006. Trong khi VM đưa toàn bộ OS lên bộ nhớ, container chia sẻ OS và chỉ tách riêng bộ nhớ, CPU. Trên hub.docker.com đã có hơn 14 triệu image được đăng ký. Độ nhẹ và tính di động này là lý do nó trở thành chuẩn.

Triết lý thiết kế skill của Perplexity — code và skill khác nhau

Skill không phải một tệp riêng lẻ mà là một thư mục. Chính độ phức tạp là chức năng. Kích hoạt dựa vào pattern matching ngầm. Progressive disclosure là nguyên tắc. Context đắt đỏ, nên mọi token phải chứa tín hiệu cao. Nếu mô hình đã biết nội dung đó, hãy xóa khỏi skill. Đây là triết lý mà người thiết kế agent cần có.

Quy trình lặp lõi của agent

Hệ thống skill hiệu quả nhất là nhẹ và được tùy chỉnh. Nếu tải xuống toàn bộ gói 20 skill, agent sẽ rơi vào hỗn loạn. Cốt lõi là điều chỉnh một số ít skill cho phù hợp với công việc của mình. Chu trình agent đi theo thứ tự nghiên cứu, prototyping, lập kế hoạch, triển khai, kiểm thử. Prompt phải được giữ ở mức tối thiểu để tránh lãng phí cửa sổ context.

⑤ Pháp luật·chính sách

Claude for Legal — ra mắt plugin cho 12 lĩnh vực thực hành

Ngày 12 tháng 5 năm 2026, Anthropic đã mở rộng mạnh các công cụ chuyên biệt cho pháp luật. Plugin cho 12 lĩnh vực thực hành như luật doanh nghiệp, lao động, quyền riêng tư, sở hữu trí tuệ, tranh tụng, governance, cùng hơn 20 MCP connector mới đã được bổ sung. Có thể dùng ngay cho các công việc pháp lý phổ biến như rà soát hợp đồng hoặc soạn thảo bản nháp. Chiến lược chuyên môn hóa của Anthropic trong thị trường AI pháp lý đang rõ hơn.

Độ phức tạp giết tổ chức nhanh hơn cạnh tranh

Cách độ phức tạp giết một tổ chức có thật là cụ thể. Quyết định chậm lại, cuộc họp và chữ ký tăng lên, tốc độ của đội bị lấy mất. Tầng nấc cấu trúc tăng lên và giao tiếp bị đứt đoạn. Quy trình quá mức làm nghẹt sức sáng tạo. Chi phí và ma sát nội bộ tăng cao. Giữ sự giản dị không phải là chiến lược, mà là vấn đề sống còn. Điều này áp dụng nguyên vẹn cho tổ chức pháp luật và chính sách.

⑥ Xu hướng công nghiệp·việc làm

Meta cắt giảm 8.000 người — tốc độ sa thải tiếp tục tăng

Tuần này Meta đã cắt giảm khoảng 8.000 người, từ 78.000 xuống 70.000. Nhìn theo tốc độ sa thải trung bình hằng ngày từng năm, con số đang tăng nhanh từ mức 600 người lên mức 1.000 người. Khi việc đưa AI vào tổ chức đi cùng hiệu quả hóa bộ máy, tốc độ sa thải trong các vị trí công nghệ có vẻ sẽ tiếp tục tăng.

Bảng xếp hạng LM Arena — tình hình thứ hạng hiện tại

Bảng xếp hạng crowdsourcing tính đến ngày 17 tháng 5. Mã màu là Claude màu xanh dương, Gemini màu đỏ, OpenAI màu vàng, open source màu xanh lá. Mô hình mới của Meta đạt thứ hạng cao ở cả văn bản và lập trình. Qwen 3.7 Max Preview cũng nổi bật. Cục diện trong đó hiệu năng trên chi phí của các mô hình Trung Quốc đe dọa mô hình Mỹ đã rõ hơn.

KIMKJ.COM
#KimKyungJin #LuatSuKimKyungJin #AIKimKyungJin #TriTueNhanTao #AI #ChuyenGiaAI #PhapLuatAI #ChinhSachAI #QuyDinhAI #DaoDucAI #AItaoSinh #ChatGPT #Claude #GPT #LLM #ChuyenDoiSo #ThanhPhoThongMinh #XeTuLai #QuyDinhDuLieu #GDPR #BaoVeDuLieuCaNhan #QuanTriAI #NghiSiKimKyungJin #ChuyenGiaPhapLy #ChinhSachCongNghe #GiaoDucAI #CachMangHanhChinhAI #CuocChienQuyenLucAI #kimkj #kimkjcom
Total Reply 0

kimkj.com Trang chủ
Lên đầu trang
Về trang chủ kimkj.com kimkj.com 홈