Mô hình và nền tảng AI

Adobe Ra Mắt Firefly Image Model 5 Với Chỉnh Sửa Lớp Và Tạo Mô Hình AI Tùy Chỉnh

mm
Thêm Unite.AI vào các nguồn ưu tiên của bạn trên Google

Adobe (ADBE ) ra mắt Firefly Image Model 5 tại Adobe MAX 2025, giới thiệu khả năng chỉnh sửa hình ảnh lớp và tạo mô hình tùy chỉnh cùng với các công cụ tạo âm thanh mở rộng. Phiên bản beta công khai này đánh dấu cập nhật AI tạo sinh quan trọng nhất của Adobe, nhắm vào các chuyên gia sáng tạo đòi hỏi sự kiểm soát cao hơn đối với nội dung tạo sinh bằng AI.

Firefly Image Model 5 tạo ra hình ảnh với độ phân giải lên đến 4 megapixel mà không cần phóng to, mang lại sự hiện thực và khả năng hiển thị con người được cải thiện. Mô hình này cung cấp một công cụ mới gọi là Prompt to Edit, kết hợp tạo hình ảnh và chỉnh sửa, cho phép người tạo nội dung mô tả các sửa đổi bằng ngôn ngữ tự nhiên. Adobe đã tích hợp các mô hình của bên thứ ba từ Topaz Bloom, ElevenLabs Multilingual v2, Google’s Gemini 2.5 Flash và Black Forest Labs’ FLUX.1 Kontext vào các ứng dụng Creative Cloud.

Chỉnh Sửa Hình Ảnh Lớp, hiện đang trong quá trình phát triển, cho phép tạo thành phần chính xác và nhận thức được ngữ cảnh, duy trì sự nhất quán về mặt hình ảnh trên tất cả các thay đổi được thực hiện đối với hình ảnh. Firefly Custom Models đã vào giai đoạn beta riêng tư hôm nay và sẽ được triển khai rộng rãi vào tháng tới, cho phép các chuyên gia sáng tạo tùy chỉnh mô hình AI bằng cách kéo và thả hình ảnh mà họ có quyền sử dụng. Các mô hình tùy chỉnh vẫn là riêng tư theo mặc định và yêu cầu sự ủy quyền của người tạo cho việc truy cập của bên thứ ba.

Hình ảnh: Adobe

Tính Năng Âm Thanh Nhắm Vào Người Tạo Video

Adobe đã giới thiệu Generate Soundtrack và Generate Speech trong phiên bản beta công khai, giải quyết các thách thức về giấy phép mà các nhà sản xuất video đã phải đối mặt. Generate Soundtrack phân tích các đoạn video được tải lên để đề xuất các bản nhạc nhạc cụ phù hợp về chủ đề, tự động đồng bộ với thời gian nội dung. Người tạo có thể chọn từ các phong cách sẵn có bao gồm lofi, hip-hop, cổ điển và EDM, hoặc mô tả các âm thanh mong muốn bằng ngôn ngữ tự nhiên. Tất cả các bản nhạc tạo ra đều có giấy phép thương mại đầy đủ.

Generate Speech kết hợp các giọng nói từ mô hình giọng nói Firefly của Adobe với các lựa chọn từ đối tác ElevenLabs, hỗ trợ tạo giọng nói từ văn bản trong nhiều ngôn ngữ. Người tạo có thể điều chỉnh nhấn mạnh, cảm xúc, nhịp độ và căng thẳng từ riêng lẻ cho việc truyền đạt giọng nói tự nhiên. Alexandru Costin, phó chủ tịch của Adobe về AI tạo sinh và Sensei, nhấn mạnh sự an toàn thương mại của cả hai công cụ, lưu ý rằng chúng được “thiết kế với người tạo nội dung trong tâm trí” để loại bỏ các cuộc tấn công DMCA và phí giấy phép.

Giá Cả Và Truy Cập Doanh Nghiệp

Firefly Image Model 5 có thể được truy cập thông qua các cấp độ đăng ký hiện có của Adobe: Tiêu chuẩn với 2.000 tín dụng tạo sinh mỗi tháng, Pro với 7.000 tín dụng mỗi tháng và Premium với 50.000 tín dụng mỗi tháng. Người đăng ký Creative Cloud All Apps sẽ nhận được 1.000 tín dụng bao gồm mỗi tháng. Cho đến ngày 1 tháng 12, người đăng ký Creative Cloud Pro và Firefly có thể tạo ra hình ảnh không giới hạn.

Adobe đã đào tạo mô hình Firefly trên nội dung được cấp phép và cung cấp bảo hiểm thương mại cho người dùng doanh nghiệp. Mô hình tự động nhúng Thông Tin Nội Dung để minh bạch. Các kế hoạch doanh nghiệp với giá tùy chỉnh và hỗ trợ chuyên dụng có sẵn cho các nhóm có hơn 250 thành viên.

Các công cụ âm thanh và hình ảnh bổ sung cho trình chỉnh sửa video dựa trên thời gian mới của Adobe trong phiên bản beta riêng tư, cho phép người tạo thêm giọng nói, bản nhạc và tiêu đề trong giao diện chỉnh sửa đa轨. Phương pháp tích hợp này giúp Adobe cạnh tranh với các công cụ tạo nhạc AI độc lập và các công cụ chỉnh sửa ảnh AI bằng cách nhúng các khả năng trực tiếp vào các quy trình làm việc Creative Cloud quen thuộc.

Alex McFarland là một nhà báo và nhà văn về trí tuệ nhân tạo, khám phá những phát triển mới nhất trong lĩnh vực trí tuệ nhân tạo. Ông đã hợp tác với nhiều công ty khởi nghiệp và xuất bản về trí tuệ nhân tạo trên toàn thế giới.