Mã nguồn mởSinh phương tiện 🇷🇺 29.07.2026 15:02

Twisterminigen: studio Krea 2 Turbo gốc trên Swift và MLX cho Mac

Moonshot AIMoonshot AI OpenAIOpenAI Alibaba/QwenAlibaba/Qwen
Nhà phát triển đã tạo Twisterminigen, một ứng dụng SwiftUI gốc để chạy suy luận Krea 2 Turbo cục bộ trên Mac mini M4 (32 GB). Ứng dụng chạy hoàn toàn không cần Python bên trong, sử dụng MLX và tạo ảnh 1024×1024 trong khoảng 7 phút. Một lỗi nghiêm trọng trong bộ mã hóa văn bản (vị trí RoPE sai cho 5 token) đã gây ra thay đổi 99,32% pixel sau khi sửa, mặc dù các bài kiểm tra độ tương tự cosine gần như hoàn hảo.
Twisterminigen là ứng dụng macOS gốc được xây dựng bằng Swift, SwiftUI và MLX, chạy Krea 2 Turbo cục bộ trên Mac mini M4 với 32 GB bộ nhớ hợp nhất. Ứng dụng không chứa Python bên trong, không suy luận đám mây và yêu cầu người dùng chấp nhận giấy phép Krea 2 trước khi sử dụng. Pipeline sử dụng Qwen3-VL-4B làm bộ mã hóa văn bản, DiT 12,9B và Qwen-Image VAE. Một lỗi tinh vi trong bộ mã hóa văn bản đã cung cấp chỉ số vị trí sai cho năm token, dẫn đến thay đổi 99,32% pixel sau khi sửa lỗi, mặc dù các bài kiểm tra độ tương tự cosin cho kết quả hoàn hảo. Ứng dụng hỗ trợ nhiều giao diện (Tối, Sáng, Kính), Hàng đợi, Cài đặt trước, nhập LoRA, Lời nhắc khu vực (Regional Prompts) và các công thức bất biến lưu trữ tất cả tham số tạo. Nhà phát triển đã sử dụng GPT‑5.6 Sol (Codex) để hỗ trợ hầu hết các thay đổi mã. Trọng số chiếm 31,18 GB, nhưng bộ nhớ được quản lý bằng cách tải tuần tự: Qwen, sau đó DiT, rồi VAE. Chế độ Best Fidelity q8 sử dụng nhiều hơn ~4,1 GiB RAM so với Default mixed-4/8. Character Sheet và lời nhắc khu vực tạo ra kết quả mạch lạc thông qua suy luận chung. Ứng dụng được phát hành dưới dạng chỉ mã nguồn theo giấy phép MIT; trọng số mô hình được lấy riêng.
Nguồn: Habr — хаб ИИ — bản gốc
Bài viết liên quan trước đây ↓
Tin mới