AITodayYour daily AI briefing

Image Generation

Jul 25, 2026

Image Generation

The Gist

Midjourney জ্যোতিষ অ্যাপ Co-Star অধিগ্রহণ করেছে এবং এর প্রতিষ্ঠাতাকে প্রধান ডিজাইন অফিসার হিসেবে নিয়োগ দিয়েছে। Black Forest Labs এর নতুন FLUX 3 মডেল ছবি, ভিডিও এবং অডিও তৈরি করতে পারে এবং Textideo প্ল্যাটফর্মে পাঠ্য থেকে সরাসরি মিডিয়া জেনারেশনের সুবিধা দেবে। এছাড়াও Tuziyo একটি নতুন বহু-মডেল এআই ইমেজ স্টুডিও চালু করেছে যেখানে ব্যবহারকারীরা বিনামূল্যে ক্রেডিট পাবেন।

Today's Stories

  1. 1

    Midjourney অধিগ্রহণ করেছে জ্যোতিষ অ্যাপ Co-Star, প্রতিষ্ঠাতাকে নিয়োগ দিয়েছে প্রধান ডিজাইন অফিসার হিসেবে

    কী ঘটলো: এআই ইমেজ-জেনারেশন স্টার্টআপ Midjourney ব্যক্তিগতকৃত জ্যোতিষ অ্যাপ Co-Star অধিগ্রহণ করেছে, চুক্তিটি বসন্তে সম্পন্ন হয়েছে। Co-Star এর প্রতিষ্ঠাতা Banu Guler অ্যাপটির দায়িত্বে থেকে যাবেন এবং একইসাথে Midjourney এর প্রধান ডিজাইন অফিসার হিসেবেও নিযুক্ত হবেন। এটি গুরুত্বপূর্ণ কেন: Co-Star মানবিক অন্তর্দৃষ্টি, ন্যাসা ডেটা এবং এআই সমন্বয় করে ব্যক্তিগতকৃত দৈনিক রাশিফল এবং সামঞ্জস্য পরীক্ষা প্রদান করে। এই অধিগ্রহণ Midjourney এর ইমেজ জেনারেশনের বাইরে ভোক্তা অ্যাপ্লিকেশনে সম্প্রসারণের ইঙ্গিত দেয়, এবং Guler এর ডিজাইন দক্ষতা Midjourney কীভাবে তার প্রথম ডেডিকেটেড অ্যাপ্লিকেশন তৈরি করে তা গঠনে সহায়তা করতে পারে।

    লক্ষ্য রাখার বিষয়: Midjourney তার প্রথম অ্যাপগুলি বিকাশ করার পরিকল্পনা করছে, যার মধ্যে ইমেজ জেনারেশনের জন্য একটি ডেডিকেটেড অ্যাপ রয়েছে। বর্তমানে, Midjourney এর এআই মডেলগুলি ওয়েব এবং Discord এর মাধ্যমে কাজ করে; এই নতুন অ্যাপগুলি স্ট্যান্ডঅ্যালোন পণ্যের দিকে একটি পরিবর্তন প্রতিনিধিত্ব করে। চুক্তির শর্তাবলী প্রকাশ করা হয়নি।

  2. 2

    Midjourney Co-Star জ্যোতিষ অ্যাপ অধিগ্রহণ করেছে

    কী ঘটেছে: ছবি এবং ভিডিও জেনারেটরের জন্য পরিচিত AI ল্যাব Midjourney সোশ্যাল জ্যোতিষ অ্যাপ Co-Star অধিগ্রহণ করেছে। চুক্তির শর্তাবলী প্রকাশ করা হয়নি। Co-Star এর প্রায় দুই ডজন কর্মচারী Midjourney তে যোগ দিয়েছেন। এটি কেন গুরুত্বপূর্ণ: Co-Star এর প্রায় ৪৩ লক্ষ মাসিক সক্রিয় ব্যবহারকারী রয়েছে এবং এটি রাশিফল এবং জ্যোতিষ সামঞ্জস্য মূল্যায়ন তৈরি করতে AI এবং মানব লেখা ব্যবহার করে। এই অধিগ্রহণ Midjourney এর মূল ছবি-প্রজন্ম ব্যবসার বাইরে ভোক্তা-মুখী অ্যাপ্লিকেশনে সম্প্রসারণের ইঙ্গিত দেয়, যা তার চিকিৎসা এবং স্পা বিভাগ তৈরির প্রচেষ্টার পরে।

    যা পর্যবেক্ষণ করতে হবে: Midjourney বর্তমানে প্রধানত Discord এর মাধ্যমে কাজ করে এবং কোনো স্বতন্ত্র অ্যাপ নেই। Co-Star এর দলের ভোক্তা অ্যাপ তৈরির অভিজ্ঞতা পরামর্শ দেয় যে Midjourney অবশেষে নিজস্ব স্বতন্ত্র অ্যাপ্লিকেশন বিকাশ করতে পারে।

  3. 3

    Black Forest Labs FLUX 3 মাল্টিমোডাল মডেল চালু করেছে যা ভিডিও, অডিও, রোবোটিক্স সমর্থন করে

    কী ঘটেছে: Black Forest Labs FLUX 3 ঘোষণা করেছে, একটি সমন্বিত মাল্টিমোডাল মডেল যা একটি একক আর্কিটেকচারে প্রশিক্ষিত এবং ছবি, ভিডিও, অডিও উৎপাদন এবং কর্ম পূর্বাভাস পরিচালনা করে। কোম্পানিটি FLUX-mimic ও প্রকাশ করেছে, একটি ভিডিও-কর্ম রোবোটিক্স মডেল যা FLUX 3-এর উপর নির্মিত এবং Audi-এর সাথে একটি একক অন-প্রিমাইসেস GPU তে বাস্তব কারখানা স্থাপনার জন্য পরীক্ষা করা হয়েছে। এটি গুরুত্বপূর্ণ কেন: FLUX 3 অন্যান্য অগ্রগামী ল্যাব দ্বারা আলাদাভাবে প্রদর্শিত ক্ষমতা পুনরুৎপাদন এবং সম্প্রসারণ করে (Gemini Omni, Grok Imagine, Seedance 2.0), এবং দল একটি ওপেন-ওয়েট ডেভেলপার সংস্করণ খোলার প্রতিশ্রুতিবদ্ধ। রোবোটিক্স প্রয়োগটি ইঙ্গিত করে যে ভিডিও ওয়ার্ল্ড মডেলিং সরাসরি রোবট নিয়ন্ত্রণে স্থানান্তরিত হতে পারে, সম্ভবত বন্ধ ইকোসিস্টেমের উপর নির্ভরতা ছাড়াই প্রতিযোগিতামূলক ওপেন মডেল তৈরিকারী ল্যাবগুলির জন্য বাধা হ্রাস করে।

    নজর রাখার মতো বিষয়: FLUX 3 ভিডিও বর্তমানে প্রাথমিক অ্যাক্সেসে রয়েছে। মডেলটির ছবি, ভিডিও, অডিও এবং রোবোটিক্স নিয়ন্ত্রণ একটি আর্কিটেকচারে একীভূত করার ক্ষমতা—যা আলাদা মডিউল হিসাবে নয় বরং যৌথভাবে প্রশিক্ষিত—এটি নির্ধারণ করবে যে মাল্টিমোডাল সিস্টেমগুলি শিল্পের মান হয়ে ওঠে নাকি কর্ম অনুযায়ী খণ্ডিত থাকে।

  4. 4

    Flux 3 Textideo প্ল্যাটফর্মে পাঠ্য থেকে ছবি এবং ভিডিও তৈরির সুবিধা নিয়ে আসছে

    কী ঘটেছে: Flux 3, একটি কৃত্রিম বুদ্ধিমত্তা ভিজ্যুয়াল ইন্টেলিজেন্স টুল, এখন Textideo প্ল্যাটফর্মে উপলব্ধ, যা ব্যবহারকারীদের পাঠ্য প্রম্পট থেকে বাস্তবসম্মত ছবি এবং ভিডিও তৈরি করতে সক্ষম করে। এই টুলটি পাঠ্য-থেকে-ছবি এবং ছবি-থেকে-ভিডিও কর্মপ্রবাহ সমর্থন করে, বিনামূল্যে এবং প্রিমিয়াম উভয় ব্যবহারকারীর জন্য প্রজন্ম উপলব্ধ—প্রিমিয়াম ব্যবহারকারীরা পরে ফলাফল পরীক্ষা করতে চলে যেতে পারেন, যখন বিনামূল্যে ব্যবহারকারীদের পৃষ্ঠাটি খোলা রাখতে হবে নতুবা কাজটি বাতিল হয়ে যাবে। এটি গুরুত্বপূর্ণ কেন: Flux 3 কোডিং বা ডিজাইন অভিজ্ঞতা ছাড়াই সৃজনশীলদের, বিপণনকারী এবং ডিজাইনারদের জন্য পেশাদার ভিজ্যুয়াল বিষয়বস্তু তৈরির প্রবেশাধিকার কমিয়ে আনে। প্ল্যাটফর্মটি সংমিশ্রণ, বিস্তারিত এবং শৈলী স্বয়ংক্রিয়ভাবে পরিচালনা করে, যা ব্যবহারকারীদের প্রযুক্তিগত বাস্তবায়নের পরিবর্তে সৃজনশীল দিকনির্দেশনার উপর মনোনিবেশ করতে দেয়। Textideo সম্পূর্ণ কর্মপ্রবাহ—প্রম্পট থেকে উৎপাদন, পূর্বরূপ এবং রপ্তানি—একটি ইকোসিস্টেমে একীভূত করে।

    কী দেখার জন্য: প্ল্যাটফর্মটি বিশ্বব্যাপী দশ হাজারের বেশি সৃজনশীল দ্বারা বিশ্বাসী হিসাবে রিপোর্ট করে। ব্যবহারকারীরা বিভিন্ন কর্মপ্রবাহ জুড়ে টুলটি অন্বেষণ করতে পারেন যার মধ্যে ই-বাণিজ্য ভিজ্যুয়াল, বিপণন উপকরণ, সোশ্যাল মিডিয়া সম্পদ, বিজ্ঞাপন সামগ্রী এবং ডিজিটাল শিল্পকর্ম রয়েছে, যার ফলাফল ব্যবহারকারীর স্তরের উপর নির্ভর করে অবিলম্বে বা চাহিদা অনুযায়ী উপলব্ধ।

  5. 5

    Tuziyo বহু-মডেল এআই ইমেজ স্টুডিও চালু করেছে বিনামূল্যে ক্রেডিট সহ

    কী ঘটেছে: Tuziyo একটি নতুন সৃজনশীল কর্মক্ষেত্র যা ব্যবহারকারীদের একক ইন্টারফেসে একাধিক এআই মডেল (GPT Image, Nano, Banana, Seedance, Grok, Recraft) ব্যবহার করে ছবি এবং ভিডিও তৈরি করতে দেয়। নতুন অ্যাকাউন্ট দশটি বিনামূল্যে ক্রেডিট পায় এবং কোনো ক্রেডিট কার্ডের প্রয়োজন নেই। এটি গুরুত্বপূর্ণ কেন: প্ল্যাটফর্মটি ইমেজ তৈরি, সম্পাদনা এবং সম্পদ প্রস্তুতিকে একটি কর্মপ্রবাহে একীভূত করে—ব্যবহারকারীরা প্রম্পট থেকে চূড়ান্ত এক্সপোর্ট পর্যন্ত (স্থির ছবি, ছোট ভিডিও, ক্রপ করা বা পুনরায় আকার দেওয়া সম্পদ) সরঞ্জাম পরিবর্তন না করে যেতে পারেন, যা বিষয়বস্তু নির্মাতা এবং বিপণন দলগুলির কাছে আবেদন করতে পারে যারা বিভিন্ন ফর্ম্যাটে পরিমার্জিত ভিজ্যুয়াল প্রয়োজন।

    লক্ষ্য করার বিষয়: প্রবেশাধিকার এখন "Open studio" বোতামের মাধ্যমে উপলব্ধ; দশটি ক্রেডিট সহ বিনামূল্যে স্তরটি নতুন ব্যবহারকারীদের জন্য প্রবেশ পয়েন্ট।

  6. 6

    Black Forest Labs FLUX 3 চালু করেছে ছবি, ভিডিও এবং অডিও তৈরির জন্য

    কী ঘটেছে: Black Forest Labs FLUX 3 প্রকাশ করেছে, একটি বহুমুখী এআই মডেল যা একটি একক নির্দেশনা থেকে ছবি এবং ২০ সেকেন্ড পর্যন্ত সম্মিলিত অডিও/ভিডিও ক্লিপ তৈরি করে। মডেলটি আলাদা মডেল একত্রিত করার পরিবর্তে ছবি, ভিডিও এবং অডিও জুড়ে যৌথভাবে প্রশিক্ষিত। এটি রোবোটিক দৃষ্টিভঙ্গি এবং ক্রিয়াকলাপেও বিস্তৃত। এটি কেন গুরুত্বপূর্ণ: FLUX 3 কোম্পানির প্রথম জনসাধারণের ভিডিও প্রজন্ম মডেল প্রতিনিধিত্ব করে এবং সৃজনশীল প্রজন্ম, সিমুলেশন, কম্পিউটার ব্যবহার এবং রোবোটিক্সকে একটি একক ক্ষমতার সংযুক্ত প্রয়োগ হিসাবে কাঠামো করে। Black Forest Labs এটিকে "ভিজ্যুয়াল ইন্টেলিজেন্স" হিসাবে অবস্থান করে—মডেল যা শারীরিক এবং ডিজিটাল পরিবেশ জুড়ে উপলব্ধি, পূর্বাভাস এবং কাজ করতে পারে—প্রতিটি পদ্ধতিকে একটি পৃথক সরঞ্জাম হিসাবে বিবেচনা করার পরিবর্তে।

    নজর রাখার মতো: FLUX 3 চারটি পণ্য লাইনের মাধ্যমে অফার করা হবে: FLUX 3 Video, FLUX 3 Image এবং FLUX 3 Act। প্রকাশটি শুরুতে সীমাবদ্ধ, যার অর্থ বিস্তৃত উপলব্ধতা বা মূল্য নির্ধারণের বিবরণ পরবর্তীতে অনুসরণ করতে পারে।

What to Watch

Midjourney এর স্বতন্ত্র অ্যাপ্লিকেশন লঞ্চ এবং FLUX 3 এর বহু-পদ্ধতিগত সক্ষমতা সম্প্রসারণ এর দিকে নজর রাখুন, কারণ এই পদক্ষেপগুলি সৃজনশীলদের জন্য ইমেজ জেনারেশন আরও সহজলভ্য এবং শক্তিশালী করতে পারে। Discord-নির্ভর কর্মপ্রবাহ থেকে স্বাধীন প্ল্যাটফর্মে যাওয়া এবং ছবি, ভিডিও ও অডিও একসাথে পরিচালনা করার ক্ষমতা কীভাবে বাজার গড়ে তুলবে তা পর্যবেক্ষণ করা অত্যন্ত গুরুত্বপূর্ণ হবে।

Sources

Share this with a friend

Send today's roundup to anyone who wants to keep up.

Get daily AI news free with AIToday

200+ AI sources, summarized in 1 minute. Email / LINE / Slack.

Sign up free