Tạo phương tiện
TomoriBot có thể tạo phương tiện truyền thông ngay trong đoạn chat: hình ảnh, video ngắn và tin nhắn thoại
bằng giọng nói. Hãy yêu cầu bot bằng ngôn ngữ tự nhiên (“vẽ cho mình một…”, “gửi nội dung đó dưới dạng tin nhắn thoại”) hoặc
sử dụng các lệnh /generate. Những tính năng nào khả dụng phụ thuộc vào nhà cung cấp bạn đã cấu hình;
xem Nhà cung cấp & model.
Tạo hình ảnhText-to-image và image-to-image, sử dụng ảnh tham chiếu từ tệp đính kèm, avatar, sticker và emoji.
Tạo videoCác đoạn clip ngắn text-to-video và image-to-video với tỷ lệ khung hình có thể tùy chỉnh.
Giọng nói: TTS & STTTin nhắn thoại Discord nguyên bản (text-to-speech) và chuyển âm thanh thành văn bản (speech-to-text).
Không phải mọi nhà cung cấp đều hỗ trợ tất cả tính năng. Khả năng tạo cục bộ (ComfyUI, máy chủ giọng nói cục bộ) khả dụng trên các phiên bản self-hosted; xem Self-Hosting.