Image Generation
Jul 25, 2026

The Gist
Midjourney জ্যোতিষ অ্যাপ Co-Star অধিগ্রহণ করেছে এবং এর প্রতিষ্ঠাতাকে প্রধান ডিজাইন অফিসার হিসেবে নিয়োগ দিয়েছে। Black Forest Labs এর নতুন FLUX 3 মডেল ছবি, ভিডিও এবং অডিও তৈরি করতে পারে এবং Textideo প্ল্যাটফর্মে পাঠ্য থেকে সরাসরি মিডিয়া জেনারেশনের সুবিধা দেবে। এছাড়াও Tuziyo একটি নতুন বহু-মডেল এআই ইমেজ স্টুডিও চালু করেছে যেখানে ব্যবহারকারীরা বিনামূল্যে ক্রেডিট পাবেন।
Today's Stories
- 1
Midjourney অধিগ্রহণ করেছে জ্যোতিষ অ্যাপ Co-Star, প্রতিষ্ঠাতাকে নিয়োগ দিয়েছে প্রধান ডিজাইন অফিসার হিসেবে
কী ঘটলো: এআই ইমেজ-জেনারেশন স্টার্টআপ Midjourney ব্যক্তিগতকৃত জ্যোতিষ অ্যাপ Co-Star অধিগ্রহণ করেছে, চুক্তিটি বসন্তে সম্পন্ন হয়েছে। Co-Star এর প্রতিষ্ঠাতা Banu Guler অ্যাপটির দায়িত্বে থেকে যাবেন এবং একইসাথে Midjourney এর প্রধান ডিজাইন অফিসার হিসেবেও নিযুক্ত হবেন। এটি গুরুত্বপূর্ণ কেন: Co-Star মানবিক অন্তর্দৃষ্টি, ন্যাসা ডেটা এবং এআই সমন্বয় করে ব্যক্তিগতকৃত দৈনিক রাশিফল এবং সামঞ্জস্য পরীক্ষা প্রদান করে। এই অধিগ্রহণ Midjourney এর ইমেজ জেনারেশনের বাইরে ভোক্তা অ্যাপ্লিকেশনে সম্প্রসারণের ইঙ্গিত দেয়, এবং Guler এর ডিজাইন দক্ষতা Midjourney কীভাবে তার প্রথম ডেডিকেটেড অ্যাপ্লিকেশন তৈরি করে তা গঠনে সহায়তা করতে পারে।
লক্ষ্য রাখার বিষয়: Midjourney তার প্রথম অ্যাপগুলি বিকাশ করার পরিকল্পনা করছে, যার মধ্যে ইমেজ জেনারেশনের জন্য একটি ডেডিকেটেড অ্যাপ রয়েছে। বর্তমানে, Midjourney এর এআই মডেলগুলি ওয়েব এবং Discord এর মাধ্যমে কাজ করে; এই নতুন অ্যাপগুলি স্ট্যান্ডঅ্যালোন পণ্যের দিকে একটি পরিবর্তন প্রতিনিধিত্ব করে। চুক্তির শর্তাবলী প্রকাশ করা হয়নি।
- 2
Midjourney Co-Star জ্যোতিষ অ্যাপ অধিগ্রহণ করেছে
কী ঘটেছে: ছবি এবং ভিডিও জেনারেটরের জন্য পরিচিত AI ল্যাব Midjourney সোশ্যাল জ্যোতিষ অ্যাপ Co-Star অধিগ্রহণ করেছে। চুক্তির শর্তাবলী প্রকাশ করা হয়নি। Co-Star এর প্রায় দুই ডজন কর্মচারী Midjourney তে যোগ দিয়েছেন। এটি কেন গুরুত্বপূর্ণ: Co-Star এর প্রায় ৪৩ লক্ষ মাসিক সক্রিয় ব্যবহারকারী রয়েছে এবং এটি রাশিফল এবং জ্যোতিষ সামঞ্জস্য মূল্যায়ন তৈরি করতে AI এবং মানব লেখা ব্যবহার করে। এই অধিগ্রহণ Midjourney এর মূল ছবি-প্রজন্ম ব্যবসার বাইরে ভোক্তা-মুখী অ্যাপ্লিকেশনে সম্প্রসারণের ইঙ্গিত দেয়, যা তার চিকিৎসা এবং স্পা বিভাগ তৈরির প্রচেষ্টার পরে।
যা পর্যবেক্ষণ করতে হবে: Midjourney বর্তমানে প্রধানত Discord এর মাধ্যমে কাজ করে এবং কোনো স্বতন্ত্র অ্যাপ নেই। Co-Star এর দলের ভোক্তা অ্যাপ তৈরির অভিজ্ঞতা পরামর্শ দেয় যে Midjourney অবশেষে নিজস্ব স্বতন্ত্র অ্যাপ্লিকেশন বিকাশ করতে পারে।
- 3
Black Forest Labs FLUX 3 মাল্টিমোডাল মডেল চালু করেছে যা ভিডিও, অডিও, রোবোটিক্স সমর্থন করে
কী ঘটেছে: Black Forest Labs FLUX 3 ঘোষণা করেছে, একটি সমন্বিত মাল্টিমোডাল মডেল যা একটি একক আর্কিটেকচারে প্রশিক্ষিত এবং ছবি, ভিডিও, অডিও উৎপাদন এবং কর্ম পূর্বাভাস পরিচালনা করে। কোম্পানিটি FLUX-mimic ও প্রকাশ করেছে, একটি ভিডিও-কর্ম রোবোটিক্স মডেল যা FLUX 3-এর উপর নির্মিত এবং Audi-এর সাথে একটি একক অন-প্রিমাইসেস GPU তে বাস্তব কারখানা স্থাপনার জন্য পরীক্ষা করা হয়েছে। এটি গুরুত্বপূর্ণ কেন: FLUX 3 অন্যান্য অগ্রগামী ল্যাব দ্বারা আলাদাভাবে প্রদর্শিত ক্ষমতা পুনরুৎপাদন এবং সম্প্রসারণ করে (Gemini Omni, Grok Imagine, Seedance 2.0), এবং দল একটি ওপেন-ওয়েট ডেভেলপার সংস্করণ খোলার প্রতিশ্রুতিবদ্ধ। রোবোটিক্স প্রয়োগটি ইঙ্গিত করে যে ভিডিও ওয়ার্ল্ড মডেলিং সরাসরি রোবট নিয়ন্ত্রণে স্থানান্তরিত হতে পারে, সম্ভবত বন্ধ ইকোসিস্টেমের উপর নির্ভরতা ছাড়াই প্রতিযোগিতামূলক ওপেন মডেল তৈরিকারী ল্যাবগুলির জন্য বাধা হ্রাস করে।
নজর রাখার মতো বিষয়: FLUX 3 ভিডিও বর্তমানে প্রাথমিক অ্যাক্সেসে রয়েছে। মডেলটির ছবি, ভিডিও, অডিও এবং রোবোটিক্স নিয়ন্ত্রণ একটি আর্কিটেকচারে একীভূত করার ক্ষমতা—যা আলাদা মডিউল হিসাবে নয় বরং যৌথভাবে প্রশিক্ষিত—এটি নির্ধারণ করবে যে মাল্টিমোডাল সিস্টেমগুলি শিল্পের মান হয়ে ওঠে নাকি কর্ম অনুযায়ী খণ্ডিত থাকে।
- 4
Flux 3 Textideo প্ল্যাটফর্মে পাঠ্য থেকে ছবি এবং ভিডিও তৈরির সুবিধা নিয়ে আসছে
কী ঘটেছে: Flux 3, একটি কৃত্রিম বুদ্ধিমত্তা ভিজ্যুয়াল ইন্টেলিজেন্স টুল, এখন Textideo প্ল্যাটফর্মে উপলব্ধ, যা ব্যবহারকারীদের পাঠ্য প্রম্পট থেকে বাস্তবসম্মত ছবি এবং ভিডিও তৈরি করতে সক্ষম করে। এই টুলটি পাঠ্য-থেকে-ছবি এবং ছবি-থেকে-ভিডিও কর্মপ্রবাহ সমর্থন করে, বিনামূল্যে এবং প্রিমিয়াম উভয় ব্যবহারকারীর জন্য প্রজন্ম উপলব্ধ—প্রিমিয়াম ব্যবহারকারীরা পরে ফলাফল পরীক্ষা করতে চলে যেতে পারেন, যখন বিনামূল্যে ব্যবহারকারীদের পৃষ্ঠাটি খোলা রাখতে হবে নতুবা কাজটি বাতিল হয়ে যাবে। এটি গুরুত্বপূর্ণ কেন: Flux 3 কোডিং বা ডিজাইন অভিজ্ঞতা ছাড়াই সৃজনশীলদের, বিপণনকারী এবং ডিজাইনারদের জন্য পেশাদার ভিজ্যুয়াল বিষয়বস্তু তৈরির প্রবেশাধিকার কমিয়ে আনে। প্ল্যাটফর্মটি সংমিশ্রণ, বিস্তারিত এবং শৈলী স্বয়ংক্রিয়ভাবে পরিচালনা করে, যা ব্যবহারকারীদের প্রযুক্তিগত বাস্তবায়নের পরিবর্তে সৃজনশীল দিকনির্দেশনার উপর মনোনিবেশ করতে দেয়। Textideo সম্পূর্ণ কর্মপ্রবাহ—প্রম্পট থেকে উৎপাদন, পূর্বরূপ এবং রপ্তানি—একটি ইকোসিস্টেমে একীভূত করে।
কী দেখার জন্য: প্ল্যাটফর্মটি বিশ্বব্যাপী দশ হাজারের বেশি সৃজনশীল দ্বারা বিশ্বাসী হিসাবে রিপোর্ট করে। ব্যবহারকারীরা বিভিন্ন কর্মপ্রবাহ জুড়ে টুলটি অন্বেষণ করতে পারেন যার মধ্যে ই-বাণিজ্য ভিজ্যুয়াল, বিপণন উপকরণ, সোশ্যাল মিডিয়া সম্পদ, বিজ্ঞাপন সামগ্রী এবং ডিজিটাল শিল্পকর্ম রয়েছে, যার ফলাফল ব্যবহারকারীর স্তরের উপর নির্ভর করে অবিলম্বে বা চাহিদা অনুযায়ী উপলব্ধ।
- 5
Tuziyo বহু-মডেল এআই ইমেজ স্টুডিও চালু করেছে বিনামূল্যে ক্রেডিট সহ
কী ঘটেছে: Tuziyo একটি নতুন সৃজনশীল কর্মক্ষেত্র যা ব্যবহারকারীদের একক ইন্টারফেসে একাধিক এআই মডেল (GPT Image, Nano, Banana, Seedance, Grok, Recraft) ব্যবহার করে ছবি এবং ভিডিও তৈরি করতে দেয়। নতুন অ্যাকাউন্ট দশটি বিনামূল্যে ক্রেডিট পায় এবং কোনো ক্রেডিট কার্ডের প্রয়োজন নেই। এটি গুরুত্বপূর্ণ কেন: প্ল্যাটফর্মটি ইমেজ তৈরি, সম্পাদনা এবং সম্পদ প্রস্তুতিকে একটি কর্মপ্রবাহে একীভূত করে—ব্যবহারকারীরা প্রম্পট থেকে চূড়ান্ত এক্সপোর্ট পর্যন্ত (স্থির ছবি, ছোট ভিডিও, ক্রপ করা বা পুনরায় আকার দেওয়া সম্পদ) সরঞ্জাম পরিবর্তন না করে যেতে পারেন, যা বিষয়বস্তু নির্মাতা এবং বিপণন দলগুলির কাছে আবেদন করতে পারে যারা বিভিন্ন ফর্ম্যাটে পরিমার্জিত ভিজ্যুয়াল প্রয়োজন।
লক্ষ্য করার বিষয়: প্রবেশাধিকার এখন "Open studio" বোতামের মাধ্যমে উপলব্ধ; দশটি ক্রেডিট সহ বিনামূল্যে স্তরটি নতুন ব্যবহারকারীদের জন্য প্রবেশ পয়েন্ট।
- 6
Black Forest Labs FLUX 3 চালু করেছে ছবি, ভিডিও এবং অডিও তৈরির জন্য
কী ঘটেছে: Black Forest Labs FLUX 3 প্রকাশ করেছে, একটি বহুমুখী এআই মডেল যা একটি একক নির্দেশনা থেকে ছবি এবং ২০ সেকেন্ড পর্যন্ত সম্মিলিত অডিও/ভিডিও ক্লিপ তৈরি করে। মডেলটি আলাদা মডেল একত্রিত করার পরিবর্তে ছবি, ভিডিও এবং অডিও জুড়ে যৌথভাবে প্রশিক্ষিত। এটি রোবোটিক দৃষ্টিভঙ্গি এবং ক্রিয়াকলাপেও বিস্তৃত। এটি কেন গুরুত্বপূর্ণ: FLUX 3 কোম্পানির প্রথম জনসাধারণের ভিডিও প্রজন্ম মডেল প্রতিনিধিত্ব করে এবং সৃজনশীল প্রজন্ম, সিমুলেশন, কম্পিউটার ব্যবহার এবং রোবোটিক্সকে একটি একক ক্ষমতার সংযুক্ত প্রয়োগ হিসাবে কাঠামো করে। Black Forest Labs এটিকে "ভিজ্যুয়াল ইন্টেলিজেন্স" হিসাবে অবস্থান করে—মডেল যা শারীরিক এবং ডিজিটাল পরিবেশ জুড়ে উপলব্ধি, পূর্বাভাস এবং কাজ করতে পারে—প্রতিটি পদ্ধতিকে একটি পৃথক সরঞ্জাম হিসাবে বিবেচনা করার পরিবর্তে।
নজর রাখার মতো: FLUX 3 চারটি পণ্য লাইনের মাধ্যমে অফার করা হবে: FLUX 3 Video, FLUX 3 Image এবং FLUX 3 Act। প্রকাশটি শুরুতে সীমাবদ্ধ, যার অর্থ বিস্তৃত উপলব্ধতা বা মূল্য নির্ধারণের বিবরণ পরবর্তীতে অনুসরণ করতে পারে।
What to Watch
Midjourney এর স্বতন্ত্র অ্যাপ্লিকেশন লঞ্চ এবং FLUX 3 এর বহু-পদ্ধতিগত সক্ষমতা সম্প্রসারণ এর দিকে নজর রাখুন, কারণ এই পদক্ষেপগুলি সৃজনশীলদের জন্য ইমেজ জেনারেশন আরও সহজলভ্য এবং শক্তিশালী করতে পারে। Discord-নির্ভর কর্মপ্রবাহ থেকে স্বাধীন প্ল্যাটফর্মে যাওয়া এবং ছবি, ভিডিও ও অডিও একসাথে পরিচালনা করার ক্ষমতা কীভাবে বাজার গড়ে তুলবে তা পর্যবেক্ষণ করা অত্যন্ত গুরুত্বপূর্ণ হবে।
Sources
- Midjourney bought the astrology app Co-Star
- Midjourney acquired the astrology app Co-Star
- [AINews] Black Forest Labs FLUX 3 - Multimodal Flow Models that beat Seedance 2.0, Gemini Omni and Grok Imagine, and FLUX-mimic video-action robotics model
- Flux 3: From AI image generation to visual intelligence
- Show HN: Tuziyo – Compare multiple AI image models in one studio
- Black Forest Labs launches FLUX 3 capable of generating images and 20-second video with audio — but in limited release to start
- Anyone heading to Jeju for KDD? Let's meet up! 🙋[D]
- Neill Blomkamp’s new zombie AI ‘film’ is just slop warmed over
- Disney's Ozzy Fox is going viral thanks to 'AI slop' accusations
- Alibaba's Qwen-Image-3.0 renders full infographic grids and readable ten-pixel text in a single pass
Share this with a friend
Send today's roundup to anyone who wants to keep up.
Get daily AI news free with AIToday
200+ AI sources, summarized in 1 minute. Email / LINE / Slack.
Sign up free