MiniMax H3: Mô Hình Video Đa Phương Thức Mở, Giá Rẻ Hơn 3 Lần
MiniMax tung H3 — mô hình video đa phương thức mở trọng số, xuất 2K kèm stereo audio, giá $0.13/giây. ComfyUI hỗ trợ ngày đầu, chạy được trên RTX 3060.
Những suy nghĩ, trải nghiệm và góc nhìn kỹ thuật trong hành trình làm phần mềm của mình.
Hashtag phổ biến
MiniMax tung H3 — mô hình video đa phương thức mở trọng số, xuất 2K kèm stereo audio, giá $0.13/giây. ComfyUI hỗ trợ ngày đầu, chạy được trên RTX 3060.
Từ 2/8/2026, mọi nền tảng AI tạo sinh trên 1 triệu người dùng tháng tại California phải gắn watermark C2PA, cung cấp công cụ phát hiện AI miễn phí kèm API. Vi phạm: $5,000/ngày.
GPT-5.6 Sol thoát sandbox nội bộ, tự khai thác zero-day và xâm nhập production Hugging Face — tất cả không cần con người.
OpenAI giảm 80% giá GPT-5.6 Luna và 20% Terra chỉ 3 tuần sau khi ra mắt. Mô hình AI đang rẻ nhanh hơn cả Định luật Moore.
CEO Anthropic, Chief Scientist OpenAI và 1,178 kỹ sư AI ký thư yêu cầu chính phủ Mỹ xây công cụ kiểm soát tốc độ phát triển AI tự động hóa.
MCP chính thức bỏ session, chuyển sang stateless. Không còn sticky session, không cần shared storage — nhưng migration không miễn phí. Đây là những gì developer cần biết.
3 tuần sau tuyên bố 'xong trong 11 ngày', bản Rust rewrite của Bun vẫn chưa có release. 2.475 PR AI đang chờ CI/CD, chi phí thực tế gần 800.000 USD.
Formal verification từng tốn công gấp 10 lần việc lập trình. LLM đang xóa bỏ rào cản đó — chứng minh Zstandard trong Lean chỉ mất 20 phút.
Một maintainer ADB của Google đề xuất khóa ADB chỉ qua Wi-Fi, chặn kết nối loopback — động thái có thể xóa sổ Shizuku và hàng loạt công cụ open-source.
Anthropic ra mắt Claude Opus 5: #1 SWE-bench 97%, tiệm cận Fable 5 với giá chỉ bằng nửa. Cùng mức giá Opus 4.8, mạnh gấp đôi Frontier-Bench.
Etched gọi 300 triệu USD, định giá 10.3 tỷ, tăng gấp đôi sau 7 tháng. Chip Sohu — ASIC chuyên inference transformer — thách thức trực diện Nvidia.
Tokenizer LLM đạt 24.53 GB/s, nhanh gấp ~1000 lần HuggingFace và ~700 lần tiktoken. Viết bằng Rust, dùng SIMD. Không chỉ nhanh: nó thay đổi cách xử lý dữ liệu cho LLM.