Image Generation
Jul 24, 2026

The Gist
Midjourney কোম্পানি Co-Star জ্যোতিষ অ্যাপ্লিকেশন অধিগ্রহণ করেছে এবং এর প্রতিষ্ঠাতাকে প্রধান ডিজাইন অফিসার হিসেবে নিয়োগ দিয়েছে। Black Forest Labs তার নতুন FLUX 3 মাল্টিমোডেল মডেল চালু করেছে যা ছবি, ভিডিও এবং অডিও তৈরিতে সক্ষম। এদিকে Tuziyo একটি নতুন বহু-মডেল এআই ইমেজ স্টুডিও প্লাটফর্ম চালু করেছে যেখানে ব্যবহারকারীরা বিনামূল্যে ক্রেডিট পাবেন।
Today's Stories
- 1
Midjourney, Co-Star অধিগ্রহণ করেছে এবং প্রতিষ্ঠাতাকে প্রধান ডিজাইন অফিসার হিসেবে নিয়োগ দিয়েছে
কী হয়েছে: কৃত্রিম বুদ্ধিমত্তা চালিত চিত্র সৃষ্টি স্টার্টআপ Midjourney বসন্তে ব্যক্তিগতকৃত জ্যোতিষ অ্যাপ Co-Star অধিগ্রহণ করেছে। Co-Star এর প্রতিষ্ঠাতা Banu Guler অ্যাপটির দায়িত্বে থাকবেন এবং একই সাথে Midjourney এর প্রধান ডিজাইন অফিসার হবেন। এটি গুরুত্বপূর্ণ কারণ: Co-Star মানব অন্তর্দৃষ্টি, NASA এর তথ্য এবং কৃত্রিম বুদ্ধিমত্তাকে একত্রিত করে ব্যক্তিগতকৃত দৈনিক রাশিফল এবং সামঞ্জস্য পরীক্ষা প্রদান করে। এই অধিগ্রহণ Midjourney এর চিত্র সৃষ্টির বাইরে ভোক্তা অ্যাপ্লিকেশনে সম্প্রসারণের ইঙ্গিত দেয়, এবং Guler এর ডিজাইন দক্ষতা Midjourney কীভাবে তার প্রথম ডেডিকেটেড অ্যাপ্লিকেশন তৈরি করবে তা গঠনে সহায়তা করতে পারে।
যা পর্যবেক্ষণ করতে হবে: Midjourney চিত্র সৃষ্টির জন্য নিবেদিত একটি সহ তার প্রথম অ্যাপ্লিকেশন বিকাশ করার পরিকল্পনা করছে। বর্তমানে, Midjourney এর কৃত্রিম বুদ্ধিমত্তা মডেলগুলি ওয়েব এবং Discord এর মাধ্যমে কাজ করে; এই নতুন অ্যাপ্লিকেশনগুলি স্বতন্ত্র পণ্যের দিকে একটি পরিবর্তনের প্রতিনিধিত্ব করে। চুক্তির শর্তাবলী প্রকাশ করা হয়নি।
- 2
Midjourney-এর দ্বারা Co-Star জ্যোতিষ অ্যাপ্লিকেশন অধিগ্রহণ
কী ঘটেছে: ছবি এবং ভিডিও জেনারেটরের জন্য পরিচিত AI ল্যাব Midjourney সামাজিক জ্যোতিষ অ্যাপ্লিকেশন Co-Star অধিগ্রহণ করেছে। চুক্তির শর্তাবলী প্রকাশ করা হয়নি। Co-Star-এর প্রায় দুই ডজন কর্মচারীর দল Midjourney-তে যোগদান করেছে। এটি কেন গুরুত্বপূর্ণ: Co-Star-এর প্রতি মাসে প্রায় ৪.৩ মিলিয়ন সক্রিয় ব্যবহারকারী রয়েছে এবং এটি জ্যোতিষ পূর্বাভাস এবং জ্যোতিষগত সামঞ্জস্য মূল্যায়ন তৈরি করতে AI এবং মানব লেখা ব্যবহার করে। এই অধিগ্রহণ চিকিৎসা এবং স্পা বিভাগ গড়ে তোলার প্রচেষ্টার পরে ভোক্তা-মুখী অ্যাপ্লিকেশনে Midjourney-এর সম্প্রসারণের ইঙ্গিত দেয়।
পর্যবেক্ষণ করার বিষয়: Midjourney বর্তমানে প্রধানত Discord-এর মাধ্যমে কাজ করে এবং কোনো স্বতন্ত্র অ্যাপ্লিকেশন নেই। Co-Star-এর দলের ভোক্তা অ্যাপ্লিকেশন তৈরির অভিজ্ঞতা পরামর্শ দেয় যে Midjourney অবশেষে নিজস্ব স্বতন্ত্র অ্যাপ্লিকেশন বিকাশ করতে পারে।
- 3
Black Forest Labs FLUX 3 মাল্টিমোডাল মডেল চালু করেছে যা ভিডিও, অডিও, রোবোটিক্স জুড়ে বিস্তৃত
কী ঘটেছে: Black Forest Labs FLUX 3 ঘোষণা করেছে, একটি একীভূত মাল্টিমোডাল মডেল যা একক আর্কিটেকচারে প্রশিক্ষিত এবং ছবি, ভিডিও, অডিও প্রজন্ম এবং অ্যাকশন পূর্বাভাস পরিচালনা করে। কোম্পানিটি FLUX-mimic ও উন্মোচন করেছে, একটি ভিডিও-অ্যাকশন রোবোটিক্স মডেল যা FLUX 3-এর উপর নির্মিত এবং একক অন-প্রিমিসেস GPU-তে বাস্তব কারখানা স্থাপনার জন্য Audi-এর সাথে পরীক্ষিত। এটি গুরুত্বপূর্ণ কেন: FLUX 3 অন্যান্য অগ্রভাগ ল্যাবগুলির দ্বারা আলাদাভাবে প্রদর্শিত ক্ষমতা পুনরুৎপাদন এবং সম্প্রসারণ করে (Gemini Omni, Grok Imagine, Seedance 2.0), দলটি একটি ওপেন-ওয়েট ডেভেলপার সংস্করণ খোলার জন্য প্রতিশ্রুতিবদ্ধ। রোবোটিক্স অ্যাপ্লিকেশনটি সংকেত দেয় যে ভিডিও বিশ্ব মডেলিং সরাসরি রোবট নিয়ন্ত্রণে স্থানান্তরিত হতে পারে, সম্ভাব্যভাবে বন্ধ ইকোসিস্টেমের উপর নির্ভরতা ছাড়াই প্রতিযোগিতামূলক ওপেন মডেল তৈরিকারী ল্যাবগুলির জন্য বাধা হ্রাস করে।
যা দেখার মতো: FLUX 3 ভিডিও বর্তমানে প্রাথমিক অ্যাক্সেসে রয়েছে। মডেলের ছবি, ভিডিও, অডিও এবং রোবোটিক্স নিয়ন্ত্রণকে একটি আর্কিটেকচারে একীভূত করার ক্ষমতা—যৌথভাবে প্রশিক্ষিত, পৃথক মডিউল হিসাবে নয়—এটি নির্ধারণ করবে যে মাল্টিমোডাল সিস্টেমগুলি শিল্প মান হয়ে উঠবে নাকি কার্য দ্বারা বিভক্ত থাকবে।
- 4
Flux 3 Textideo প্ল্যাটফর্মে পাঠ্য-থেকে-চিত্র এবং ভিডিও প্রজন্ম নিয়ে আসে
কী ঘটেছে: Flux 3, একটি কৃত্রিম বুদ্ধিমত্তা ভিজ্যুয়াল ইন্টেলিজেন্স সরঞ্জাম, এখন Textideo প্ল্যাটফর্মে উপলব্ধ, যা ব্যবহারকারীদের পাঠ্য প্রম্পট থেকে বাস্তবসম্মত চিত্র এবং ভিডিও তৈরি করতে সক্ষম করে। সরঞ্জামটি পাঠ্য-থেকে-চিত্র এবং চিত্র-থেকে-ভিডিও কর্মপ্রবাহ সমর্থন করে, প্রজন্ম বিনামূল্যে এবং প্রিমিয়াম উভয় ব্যবহারকারীর জন্য উপলব্ধ—প্রিমিয়াম ব্যবহারকারীরা ফলাফল পরে পরীক্ষা করে ছেড়ে যেতে পারেন, যখন বিনামূল্যে ব্যবহারকারীদের অবশ্যই পৃষ্ঠা খোলা রাখতে হবে অথবা কাজটি বাতিল হয়। এটি কেন গুরুত্বপূর্ণ: Flux 3 কোডিং বা ডিজাইন অভিজ্ঞতা ছাড়াই সৃজনশীল, বিপণনকারী এবং ডিজাইনারদের জন্য পেশাদার ভিজ্যুয়াল সামগ্রী তৈরির বাধা কমায়। প্ল্যাটফর্মটি স্বয়ংক্রিয়ভাবে রচনা, বিবরণ এবং শৈলী পরিচালনা করে, ব্যবহারকারীদের প্রযুক্তিগত সম্পাদনের পরিবর্তে সৃজনশীল দিকনির্দেশনায় মনোনিবেশ করতে দেয়। Textideo সম্পূর্ণ কর্মপ্রবাহ—প্রম্পট থেকে প্রজন্ম, পূর্বরূপ এবং রপ্তানি পর্যন্ত—একটি ইকোসিস্টেমে একীভূত করে।
লক্ষ্য করার বিষয়: প্ল্যাটফর্মটি বিশ্বব্যাপী দশ হাজারেরও বেশি সৃজনশীলদের দ্বারা বিশ্বস্ত বলে রিপোর্ট করে। ব্যবহারকারীরা ই-কমার্স ভিজ্যুয়াল, বিপণন উপকরণ, সোশ্যাল মিডিয়া সম্পদ, বিজ্ঞাপন সামগ্রী এবং ডিজিটাল শিল্পকর্ম সহ বিভিন্ন কর্মপ্রবাহ জুড়ে সরঞ্জাম অন্বেষণ করতে পারেন, ফলাফল ব্যবহারকারী স্তরের উপর নির্ভর করে তাৎক্ষণিক বা চাহিদা অনুযায়ী উপলব্ধ।
- 5
Tuziyo বহু-মডেল এআই ইমেজ স্টুডিও চালু করেছে বিনামূল্যে ক্রেডিট সহ
কী ঘটেছে: Tuziyo একটি নতুন সৃজনশীল কর্মক্ষেত্র যা ব্যবহারকারীদের একটি একক ইন্টারফেসে একাধিক এআই মডেল (GPT Image, Nano, Banana, Seedance, Grok, Recraft) ব্যবহার করে ছবি এবং ভিডিও তৈরি করতে দেয়। নতুন অ্যাকাউন্টগুলি কোনো ক্রেডিট কার্ডের প্রয়োজন ছাড়াই দশটি বিনামূল্যে ক্রেডিট পায়। গুরুত্বপূর্ণ কারণ: প্ল্যাটফর্মটি ইমেজ জেনারেশন, সম্পাদনা এবং সম্পদ প্রস্তুতিকে একটি ওয়ার্কফ্লোতে একীভূত করে—ব্যবহারকারীরা টুল পরিবর্তন করা ছাড়াই প্রম্পট থেকে চূড়ান্ত এক্সপোর্ট (স্থির ছবি, সংক্ষিপ্ত ভিডিও, ক্রপ করা বা পুনরায় আকার দেওয়া সম্পদ) এ যেতে পারে, যা বিষয়বস্তু নির্মাতা এবং বিভিন্ন ফরম্যাটে পরিমার্জিত ভিজ্যুয়াল প্রয়োজনীয় মার্কেটিং দলগুলিকে আবেদন করতে পারে।
লক্ষ্য রাখার মতো বিষয়: অ্যাক্সেস এখন "Open studio" বোতামের মাধ্যমে উপলব্ধ; দশটি ক্রেডিট সহ বিনামূল্যে স্তর নতুন ব্যবহারকারীদের জন্য প্রবেশবিন্দু।
- 6
Black Forest Labs FLUX 3 লঞ্চ করেছে ছবি, ভিডিও এবং অডিও তৈরির জন্য
কী ঘটেছে: Black Forest Labs FLUX 3 রিলিজ করেছে, একটি মাল্টিমোডাল AI মডেল যা একটি একক প্রম্পট থেকে চব্বিশ সেকেন্ড পর্যন্ত ছবি এবং অডিও/ভিডিও ক্লিপ তৈরি করতে পারে। মডেলটি আলাদা মডেল একত্রিত করার পরিবর্তে ছবি, ভিডিও এবং অডিও জুড়ে যৌথভাবে প্রশিক্ষিত। এটি রোবোটিক দৃষ্টি এবং ক্রিয়াকলাপেও বিস্তৃত। কেন এটি গুরুত্বপূর্ণ: FLUX 3 কোম্পানির প্রথম সর্বজনীন ভিডিও তৈরির মডেল এবং সৃজনশীল প্রজন্ম, সিমুলেশন, কম্পিউটার ব্যবহার এবং রোবোটিক্সকে একটি একক ক্ষমতার সংযুক্ত অ্যাপ্লিকেশন হিসাবে তুলে ধরে। Black Forest Labs এটিকে "ভিজ্যুয়াল ইন্টেলিজেন্স" হিসাবে অবস্থান করে—এমন মডেল যা শারীরিক এবং ডিজিটাল পরিবেশ জুড়ে উপলব্ধি করতে, পূর্বাভাস দিতে এবং কাজ করতে পারে—বরং প্রতিটি মোডালিটিকে একটি আলাদা সরঞ্জাম হিসাবে বিবেচনা করার পরিবর্তে।
লক্ষ্য রাখার বিষয়: FLUX 3 চারটি পণ্য লাইনের মাধ্যমে অফার করা হবে: FLUX 3 Video, FLUX 3 Image এবং FLUX 3 Act। রিলিজটি শুরুতে সীমিত, যার অর্থ বিস্তৃত প্রাপ্যতা বা মূল্য নির্ধারণের বিবরণ পরবর্তীতে অনুসরণ করতে পারে।
What to Watch
আগামী দিনগুলোতে Midjourney-এর নিজস্ব ডেডিকেটেড অ্যাপ্লিকেশন চালু হওয়া এবং FLUX 3-এর মতো মাল্টিমোডাল সিস্টেমগুলি শিল্পে কীভাবে প্রভাব ফেলে তা লক্ষ্য রাখুন, কারণ এই উন্নয়নগুলি আর্টিফিশিয়াল ইন্টেলিজেন্স চিত্র এবং ভিডিও সৃষ্টির ভবিষ্যৎ নির্ধারণ করবে। বিশেষত, পর্যবেক্ষণ করুন কীভাবে এই প্ল্যাটফর্মগুলি ব্যবহারকারী অ্যাক্সেস এবং মূল্য নির্ধারণে সম্প্রসারিত হয় এবং সৃজনশীল পেশাদারদের জন্য ব্যবহারিক সরঞ্জাম হিসাবে প্রতিষ্ঠিত হয়।
Sources
- Midjourney bought the astrology app Co-Star
- Midjourney acquired the astrology app Co-Star
- [AINews] Black Forest Labs FLUX 3 - Multimodal Flow Models that beat Seedance 2.0, Gemini Omni and Grok Imagine, and FLUX-mimic video-action robotics model
- Flux 3: From AI image generation to visual intelligence
- Show HN: Tuziyo – Compare multiple AI image models in one studio
- Black Forest Labs launches FLUX 3 capable of generating images and 20-second video with audio — but in limited release to start
- Anyone heading to Jeju for KDD? Let's meet up! 🙋[D]
- Neill Blomkamp’s new zombie AI ‘film’ is just slop warmed over
- Disney's Ozzy Fox is going viral thanks to 'AI slop' accusations
- Alibaba's Qwen-Image-3.0 renders full infographic grids and readable ten-pixel text in a single pass
Share this with a friend
Send today's roundup to anyone who wants to keep up.
Get daily AI news free with AIToday
200+ AI sources, summarized in 1 minute. Email / LINE / Slack.
Sign up free