-
راهاندازی پلتفرم انتشار کتاب صوتی با هوش مصنوعی توسط ElevenLabs
شرکت ElevenLabs، یک استارتاپ فعال در زمینه هوش مصنوعی صدا، اپلیکیشن خود را برای انتشار کتابهای صوتی با فناوری هوش مصنوعی راهاندازی کرد. این پلتفرم به نویسندگان اجازه میدهد کتابهای صوتی خود را منتشر کنند و در ازای هر ۱۱ دقیقه گوش داده شدن به کتاب صوتیشان، حدود ۱.۱۰ دلار درآمد کسب کنند.
۱۴۰۳/۱۲/۸ ۱۱:۱۳:۵۰ -
اسپاتیفای مجوز انتشار کتابهای صوتی با صدای هوش مصنوعی را صادر کرد
اسپاتیفای همکاری با ElevenLabs را آغاز کرده و اجازه انتشار کتابهای صوتی با صدای مصنوعی را در پلتفرم خود داده است. نویسندگان میتوانند کتابهای صوتی خود را در ۲۹ زبان با استفاده از فناوری هوش مصنوعی تولید کنند. این اقدام با واکنشهای متفاوت در جامعه نشر همراه شده و نگرانیهایی درباره کیفیت محتوای تولید شده وجود دارد.
۱۴۰۳/۱۲/۲ ۲۱:۳۶:۲۴ -
کتاب صوتی ملانیا ترامپ با صدای مصنوعی منتشر شد
📚 ملانیا ترامپ نسخه صوتی کتاب خاطرات خود را با صدای مصنوعی شبیهسازیشده خودش منتشر کرد و آن را «آغاز عصر جدید نشر» نامید. 🎙️🤖
این کتاب با همکاری شرکت ElevenLabs ساخته شده و فعلاً به زبان انگلیسی در سایت شخصی او در دسترس است، اما قرار است به بیش از ۳۰ زبان دیگر نیز منتشر شود. 🌍📕
هرچند کتاب چاپی در لیست پرفروشها قرار گرفت، فقط ۸۵ هزار نسخه در هفته اول فروخت؛ رقمی بسیار کمتر از کتاب میشل اوباما. 📉📖
ملانیا در کتاب از زندگی شخصیاش میگوید و موضعی موافق با حق سقط جنین اتخاذ میکند. ⚖️🗣️
با وجود انتقادها از نبود احساس انسانی در صدای هوش مصنوعی، ElevenLabs این پروژه را نقطهعطفی در کتابهای صوتی میداند. 🚀🔊۱۴۰۴/۳/۵ ۰۲:۴۹:۲۱ -
هوش مصنوعی، راهکار جدید Audible برای گسترش کتابهای صوتی
🎧📚 Audible، سرویس کتاب صوتی آمازون، با همکاری ناشران، کتابهای چاپی و الکترونیکی را به کتابهای صوتی با صدای هوش مصنوعی تبدیل میکند! 🚀🤖 این قابلیت با انتخاب از بین ۱۰۰ صدای هوش مصنوعی به زبانهای مختلف، از جمله انگلیسی، فرانسوی، اسپانیایی و ایتالیایی، ارائه میشود. 🌍🔊
Audible همچنین قابلیت ترجمه هوش مصنوعی متن به متن و گفتار به گفتار را بهزودی فعال میکند. اما برخی ناشران نگران کاهش کیفیت کتابهای صوتی با صدای هوش مصنوعی هستند. 📉💬
این اقدام با هدف گسترش سریع کاتالوگ کتابهای صوتی و رقابت با اپل و اسپاتیفای انجام میشود.۱۴۰۴/۲/۳۰ ۰۵:۰۶:۰۶ -
سرمایهگذاری Spotify برای گسترش کتابهای صوتی غیر انگلیسی
اسپاتیفای برای افزایش تولید کتابهای صوتی به زبانهای غیر انگلیسی، بهویژه فرانسوی و هلندی، بیش از یک میلیون دلار سرمایهگذاری میکند. این اقدام بهدلیل کمبود کتابهای صوتی در این زبانها و رقابت با پلتفرمهایی مثل Audible انجام میشود.
در فرانسه تنها ۳٪ از کتابها بهصورت صوتی در دسترس هستند و در هلند نیز این نسبت پایین است. اسپاتیفای میخواهد با کاهش هزینه تولید، از جمله استفاده از راویان انسانی و همچنین همکاری با شرکت ElevenLabs برای روایت صوتی با هوش مصنوعی، ناشران را به تولید بیشتر تشویق کند؛ هرچند این همکاری با واکنشهایی در صنعت نشر مواجه شده است.۱۴۰۴/۱/۳۱ ۱۵:۵۷:۵۴ -
اپل برای تقویت Siri به سراغ هوش مصنوعی گوگل رفت!
بلومبرگ گزارش داد اپل قصد دارد برای نسخه جدید دستیار صوتی «سیری» (Siri) ، از مدل هوش مصنوعی شرکت گوگل یعنی Gemini استفاده کند. این مدل تا زمان آمادهشدن سیستم اختصاصی اپل، بهصورت موقت در سیری به کار گرفته میشود. 💬
بهگفتهی منابع آگاه، دو شرکت در حال نهاییکردن قراردادی هستند که براساس آن اپل سالانه حدود یک میلیارد دلار به گوگل برای استفاده از این فناوری پرداخت میکند. این مدل پیچیدگی بسیار بیشتری نسبت به سیستمهای فعلی اپل دارد و میتواند توانایی سیری را در انجام درخواستهای چندمرحلهای بهبود دهد. 🤖
در این همکاری، فناوری جستوجوی گوگل وارد سیستمعاملهای اپل نخواهد شد و فقط به بهبود عملکرد سیری محدود میشود. اپل پیشتر اعلام کرده بود که ارتقای هوش مصنوعی سیری تا سال ۲۰۲۶ به تعویق افتاده است. ⏳
این تصمیم در حالی اتخاذ میشود که گوگل و آمازون پیشتر نسخههای هوشمندتر از دستیارهای خود را عرضه کردهاند و اپل با تغییرات مدیریتی تلاش دارد دوباره در رقابت هوش مصنوعی پیشتاز شود. 🚀۱۴۰۴/۸/۱۶ ۰۰:۵۱:۰۳ -
نوآوری در هوش مصنوعی صوتی همچنان ادامه دارد
مدیرعامل ElevenLabs (استارتاپ فعال در حوزه هوش مصنوعی صوتی) در کنفرانس TechCrunch Disrupt 2025 اعلام کرد مدلهای هوش مصنوعی در چند سال آینده به فناوریهای عمومی و در دسترس همه تبدیل خواهند شد. 🤖
او گفت تمرکز فعلی شرکت بر بهبود مدلهای صوتی اختصاصی است، زیرا کیفیت و طبیعی بودن صدا هنوز چالشی اساسی است. 🎧 بهگفته او، در یک تا دو سال آینده مدلهای چندوجهی که صدا، تصویر و متن را همزمان تولید میکنند، رشد زیادی خواهند داشت؛ مانند مدل Veo 3 گوگل. 🧠
شرکت قصد دارد با همکاریهای جدید و بهرهگیری از فناوریهای متنباز، میان توسعه مدلها و کاربردهای واقعی تعادل ایجاد کند تا ارزش بلندمدتی مشابه ترکیب نرمافزار و سختافزار در اپل بسازد. 🍏🚀
محصولات این شرکت در پلتفرمهایی مانند دوبله ویدیو، پادکست، بازیهای ویدئویی، کتابهای صوتی و محتوای آموزشی استفاده میشوند.۱۴۰۴/۸/۹ ۱۰:۱۹:۰۲ -
اسپیکر ۳۶۰ درجه گوگل؛ نسل تازهای از هوش مصنوعی خانگی
گوگل پس از پنج سال، نسل جدید اسپیکر هوشمند خود با نام Google Home Speaker را معرفی کرد. 🔊 این مدل با پردازنده اختصاصی برای اجرای Gemini AI طراحی شده تا پاسخها سریعتر و طبیعیتر باشند. 🧠 ویژگی Gemini Live مکالمه بدون گفتن «Hey Google» را ممکن کرده و در کارهایی مانند خرید، آشپزی و کنترل وسایل خانه کمک میکند. 🍳🏠 اسپیکر میتواند از طریق سیستم هوشمند خانه، چراغها را با فرمان صوتی خاموش یا روشن کند و حتی دستوراتی مانند «تمام چراغها را خاموش کن جز یکی» را انجام دهد. 💡این مدل صدای ۳۶۰ درجه دارد و میتوان دو دستگاه را برای صدای استریو جفت کرد. 🎶
طراحی آن شامل حلقه نوری در پایین و چهار رنگ جدید است. 🌿🎨
قیمت دستگاه ۱۰۰ دلار بوده و عرضه آن در بهار ۲۰۲۶ انجام میشود. 🗓️۱۴۰۴/۷/۱۷ ۰۸:۱۵:۵۵ -
مدل GPT-5 Pro از راه رسید؛ دقیقتر، عمیقتر و آماده برای صنایع مالی و پزشکی
OpenAI در رویداد Dev Day از مدلهای جدید خود رونمایی کرد؛ از جمله GPT-5 Pro برای پردازش عمیقتر متن، مدل ویدیوساز Sora 2 و مدل صوتی کوچکتر و ارزانتر gpt-realtime mini. این بهروزرسانیها برای جذب توسعهدهندگان و ساخت اپلیکیشن در ChatGPT ارائه شدهاند. 💡.
مدل GPT-5 Pro برای حوزههایی مثل مالی، حقوقی و پزشکی طراحی شده و دقت و قدرت استدلال بالاتری دارد. سم آلتمن، مدیرعامل OpenAI، گفت تعامل صوتی بهزودی یکی از روشهای اصلی ارتباط با هوش مصنوعی خواهد شد. 🎙️
مدل صوتی gpt-realtime mini با پشتیبانی از گفتوگوی زنده و کیفیت بالا، ۷۰٪ ارزانتر از مدل قبلی است. 🔊.
مدل Sora 2 نیز اکنون برای توسعهدهندگان در API در دسترس است و ویدیوهای واقعی با صدا و جلوههای هماهنگ تولید میکند. 🎬
اپلیکیشن Sora هم رقیب TikTok است و به کاربران امکان میدهد با یک دستور متنی، ویدیوهای کوتاه بسازند و به اشتراک بگذارند.۱۴۰۴/۷/۱۶ ۰۱:۰۷:۰۵ -
آمازون نخستین Kindle Scribe رنگی را معرفی کرد؛ تجربهای متفاوت برای کتابخوانها
آمازون در رویداد سختافزاری پاییزه خود از نسخه جدید کتابخوان Kindle Scribe و نخستین مدل رنگی آن با امکانات هوش مصنوعی رونمایی کرد. 📚 این دستگاه با نمایشگر ۱۱ اینچی بدون بازتاب، ضخامت ۵.۴ میلیمتر و وزن ۴۰۰ گرم عرضه میشود و سرعت نوشتن و ورقزدن آن ۴۰ درصد افزایش یافته است. آمازون اعلام کرد شیشه جدید این محصول حس نوشتن روی کاغذ را شبیهسازی میکند. ✍️
همچنین مدل Kindle Scribe Colorsoft با فناوری نمایش رنگ نرم و بدون آسیب به چشم معرفی شد که از باتری چند هفتهای بهره میبرد .
هر دو مدل به امکانات هوش مصنوعی مجهز شدهاند که شامل خلاصهسازی یادداشتها، جستوجوی هوشمند در میان دفترچهها و امکان ارسال به الکسا برای تعامل بیشتر است. 🤖۱۴۰۴/۷/۱۰ ۰۲:۰۸:۰۷ -
صدای شفاف در سرعت ۳۲۰ کیلومتر؛ فرمول یک روی موج نوآوری Hance
استارتاپ نروژی Hance نرمافزار پردازش صدایی ساخته که بسیار کوچک و سریع است و توجه شرکتهایی مثل Intel و Riedel Communications (تأمینکننده رسمی رادیوهای فرمول یک) را جلب کرده است. این شرکت تنها ۱۰ کارمند دارد، اما توانسته مدلهای پردازش خود را به حجم بسیار پایین ۲۴۲ کیلوبایت برساند. این یعنی پردازش صدا روی همان دستگاه و در لحظه انجام میشود و دیگر نیازی به فضای ابری نیست. 🎧🚀
فناوری Hance میتواند نویز، پژواک و صداهای مزاحم را حذف کند و وضوح صدا را تنها با ۱۰ میلیثانیه تأخیر بالا ببرد. همین باعث شده رادیوهای فرمول یک و حتی بخشهای امنیتی و دفاعی از آن استقبال کنند. همکاری با اینتل هم باعث شده این فناوری روی تراشههای جدید، از جمله «واحدهای پردازش عصبی»، اجرا شود. 💻⚡۱۴۰۴/۷/۱۰ ۰۱:۵۷:۳۴ -
اپل متهم به استفاده غیرقانونی از کتابهای نویسندگان برای آموزش هوش مصنوعی
اپل در آمریکا با شکایت گروهی از نویسندگان روبهرو شده است. این نویسندگان میگویند اپل بدون اجازه و بدون پرداخت حقالتألیف، از کتابهایشان برای آموزش سیستمهای هوش مصنوعی خود استفاده کرده است. دادخواست در دادگاه فدرال کالیفرنیا ثبت شده و نویسندگان ادعا کردهاند آثارشان در دیتاستهای غیرقانونی به کار رفته است. 📚⚖️
این پرونده بخشی از موج بزرگ شکایتها علیه شرکتهای فناوری است که متهم به استفاده غیرمجاز از محتوای نویسندگان و رسانهها برای آموزش هوش مصنوعی شدهاند. پیشتر، استارتاپ Anthropic برای پایان دادن به دعوای مشابهی پذیرفت ۱.۵ میلیارد دلار غرامت بپردازد؛ مایکروسافت، متا و OpenAI نیز با پروندههای مشابهی روبهرو هستند. ✅🤖۱۴۰۴/۶/۱۶ ۱۲:۳۵:۰۳ -
غرامت ۳ هزار دلاری برای هر کتاب؛ نویسندگان بر سر هوش مصنوعی به پیروزی رسیدند
شرکت Anthropic موافقت کرده است ۱.۵ میلیارد دلار بپردازد تا شکایت نویسندگان و ناشران بابت استفاده غیرقانونی از ۷ میلیون کتاب برای آموزش چتبات «Claude» پایان یابد. طبق این توافق، که هنوز باید به تأیید دادگاه برسد، به هر نویسنده حدود ۳ هزار دلار بابت هر کتاب پرداخت خواهد شد. این مبلغ بزرگترین تسویه تاریخ پروندههای کپیرایت در آمریکا به شمار میرود. 🤝📚
دادگاه قبلاً اعلام کرده بود استفاده از کتابها برای آموزش مدلهای هوش مصنوعی «منصفانه» است، اما نگهداری آنها در یک کتابخانه دیجیتال نقض قانون محسوب میشود. Anthropic با ارزشی حدود ۱۸۳ میلیارد دلار همچنان با پروندههای دیگری از سوی Reddit و گروهی از نویسندگان روبهرو است. ✅⚖️۱۴۰۴/۶/۱۶ ۱۲:۲۴:۴۱ -
گوگل، NotebookLM را به 80 زبان گسترش داد
گوگل اعلام کرد قابلیت Video Overviews در ابزار NotebookLM اکنون از ۸۰ زبان از جمله فارسی، فرانسوی، آلمانی، اسپانیایی و ژاپنی پشتیبانی میکند. این ویژگی به کاربران امکان میدهد یادداشتها، فایلهای PDF و تصاویر خود را به ویدیوهای آموزشی تبدیل کنند؛ قابلیتی که پیشتر فقط برای زبان انگلیسی فعال بود. 🎥🌍
همچنین قابلیت Audio Overviews ارتقا یافته و خلاصههای صوتی در زبانهای غیرانگلیسی اکنون جزئیات بیشتری ارائه میدهند. کاربران میتوانند بسته به نیاز، نسخه کوتاه یا کامل خلاصهها را دریافت کنند. 🎧📑۱۴۰۴/۶/۵ ۰۷:۴۹:۳۵ -
چتبات هوش مصنوعی شکست خورد؛ بانک استرالیا کارمندان اخراجشده را بازگرداند!
بانک Commonwealth استرالیا ماه گذشته ۴۵ کارمند خدمات مشتری را با هدف جایگزینی با یک چتبات صوتی اخراج کرد، اما بهدلیل افزایش تماسها و ناکارآمدی سیستم مجبور شد آنها را بازگرداند. اتحادیه کارکنان بانکی اعلام کرد برخلاف ادعای بانک، حجم تماسها کاهش نیافته و حتی مدیران مجبور به پاسخگویی شدهاند. 🤖📞
بانک اعتراف کرد تصمیم اولیه اشتباه بوده و نقش کارکنان همچنان ضروری است. اتحادیه این عقبنشینی را یک پیروزی دانست، هرچند کارکنان با استرس و آسیب زیادی روبهرو شدند. ✅👥
این اتفاق نشان میدهد جایگزینی عجولانه نیروی انسانی با هوش مصنوعی همچنان پرریسک است؛ تحقیقی از MIT نیز تأیید کرده که تاکنون ۹۵٪ پروژههای آزمایشی هوش مصنوعی در شرکتها شکست خوردهاند. 📊⚡۱۴۰۴/۶/۳ ۱۲:۱۴:۰۵ -
اپل در حال توسعه Siri جدید با هوش مصنوعی
اپل در حال توسعه Siri جدید مبتنی بر هوش مصنوعی است که میتواند تنها با فرمان صوتی، کارهایی مانند جستجو، ویرایش و ارسال عکس، خرید آنلاین، ورود به حسابها و کنترل کامل اپلیکیشنها را انجام دهد؛ قابلیتی که تجربه کاربری را در تمام دستگاههای اپل دگرگون میکند. 🎙️📱
این پروژه که اولویت اصلی اپل است، بهار آینده همراه با بازسازی زیرساخت سیری عرضه میشود، هرچند چالشهایی مانند پشتیبانی از اپلیکیشنهای مختلف و دقت بالا در حوزههای حساس وجود دارد. موفقیت در این طرح میتواند اپل را به رهبر موج جدید هوش مصنوعی بدل کند، اما شکست آن ممکن است کاربران را به سمت رقبایی چون OpenAI سوق دهد. ✅🚀۱۴۰۴/۵/۲۲ ۰۳:۳۱:۵۸ -
متا ۲۰۰ میلیون دلار برای جذب استعداد اپل هزینه کرد!
🔹 متا با صرف ۲۰۰ میلیون دلار برای جذب یک متخصص هوش مصنوعی از اپل با نام «رومینگ پنگ» (Ruoming Pang) و استخدام چندین نفر از OpenAI، تلاش دارد دستیار صوتی عینکهای هوشمند خود را ارتقا دهد. ✅🕶️
هدف متا، بهبود تجربه کار با عینکهای Ray-Ban با استفاده از مدلهای زبانی پیشرفته است؛ چون این دستگاهها فاقد نمایشگرند و تعامل با آنها به عملکرد دستیار صوتی وابسته است. ✅🤖
این رویکرد میتواند متا را در رقابت عینکهای هوشمند از رقبایی مانند اپل جلو بیندازد. ✅🚀۱۴۰۴/۴/۲۳ ۱۲:۱۷:۵۶ -
تحول بزرگ در سیری: اپل به دنبال همکاری با OpenAI و Anthropic
اپل در حال بررسی استفاده از مدلهای هوش مصنوعی OpenAI یا Anthropic برای ارتقای دستیار صوتی سیری است؛ اقدامی که نشاندهنده تغییر راهبرد از مدلهای داخلی به راهکارهای بیرونی است. 🤖
گزارش بلومبرگ میگوید مذاکرات با این شرکتها برای اجرای مدلها روی زیرساخت ابری اپل آغاز شده، اما هنوز تصمیم نهایی گرفته نشده است. ☁️
این در حالیست که اپل بهروزرسانیهای سیری را تا سال ۲۰۲۶ به تعویق انداخته و همزمان ابزارهای هوش مصنوعی خود و OpenAI را در اختیار توسعهدهندگان قرار داده است. 🛠️۱۴۰۴/۴/۱۲ ۰۱:۰۴:۴۱ -
امضای بیش از ۱۱۰۰ نویسنده در حمایت از محدودیت هوش مصنوعی
گروهی از نویسندگان سرشناس با انتشار نامهای سرگشاده از ناشران کتاب خواستهاند استفاده از ابزارهای هوش مصنوعی را محدود کرده و به حفظ نیروی انسانی در صنعت نشر متعهد بمانند. ✍️
در این نامه آمده که شرکتهای فناوری بدون پرداخت هزینه، از کتابهای آنها برای آموزش مدلهای هوش مصنوعی استفاده کردهاند؛ در نتیجه، به جای پرداخت سهمی به نویسندگان، سود آن نصیب شرکتهایی شده که از تلاش آنها بهره بردهاند. 💰
از جمله خواستههای اصلی این نویسندگان، تعهد ناشران به عدم انتشار کتابهای تولیدشده با هوش مصنوعی، استفاده از راویان انسانی برای کتابهای صوتی، و جلوگیری از جایگزینی کارکنان با ابزارهای خودکار است. 📚
این نامه ابتدا با امضای دهها نویسنده منتشر شد، اما تنها در ۲۴ ساعت بیش از ۱۱۰۰ امضای دیگر نیز به آن اضافه شد. 📈
همزمان، برخی نویسندگان نیز از شرکتهای فناوری بهدلیل استفاده بدون اجازه از آثارشان شکایت کردهاند، اما اخیراً دادگاههای فدرال در آمریکا بخش زیادی از این شکایات را رد کردهاند. ⚖️۱۴۰۴/۴/۹ ۲۲:۲۸:۰۸ -
ChatGPT با لحنی انسانیتر از همیشه
قابلیت گفتوگوی صوتی در ChatGPT با ارتقاء جدیدی همراه شده که صدای آن را طبیعیتر، روانتر و احساسیتر از قبل میکند. 🎙️
بهگفته OpenAI، نسخه جدید «صدای پیشرفته» با لحن واقعیتر، مکثهای طبیعی، تأکید مناسب و بیان دقیقتر احساساتی مانند همدلی یا طعنه طراحی شده است. 🧠
ویژگی ترجمه زنده نیز بهبود یافته و اکنون کاربران میتوانند بدون وقفه، گفتوگوهای چندزبانه را ادامه دهند تا زمانی که بخواهند زبان را تغییر دهند یا متوقف کنند. 🌍
این قابلیت برای همه کاربران سرویس پولی در تمامی پلتفرمها فعال است، هرچند ممکن است گاهی افت کیفیت صوتی یا خطاهای محدود مانند صداهای غیرمنتظره یا موسیقی پسزمینه رخ دهد. ⚠️۱۴۰۴/۳/۲۰ ۱۸:۲۷:۱۹ -
کتاب The Optimist: روایتی بیپرده از فراز و فرود سم آلتمن در دنیای هوش مصنوعی
📚 کتاب جدید «خوشبین: سم آلتمن، OpenAI و رقابت برای ساخت آینده» (The Optimist: Sam Altman, OpenAI, and the Race to Invent the Future) ، نوشته کیچ هیگی (Keach Hagey)، خبرنگار والاستریت ژورنال، نگاهی عمیق به زندگی و حرفه سم آلتمن دارد. 🧠
📌 از کودکی در غرب میانه آمریکا تا استارتاپها، شتابدهنده Y Combinator و نهایتاً OpenAI، مسیر او بررسی شده است. 📈
🔥 بخش مهمی به بحران برکناری و بازگشت آلتمن در OpenAI و ساختار پیچیده این شرکت میپردازد که ممکن است جذب سرمایه را دشوار کند. 🏛️💸
🎙️ هیگی تأکید دارد آلتمن باوجود دیدگاههای پیشرو، همکاریهای مهمی با دولت ترامپ در زمینه زیرساختها داشته است. 🏗️
👨👩👦 خانواده ایدهگرا و تجربههای شخصی آلتمن، نگاه مثبتش به جهان را شکل دادهاند.
🌐 این کتاب، تصویری از یک چهره بانفوذ سیلیکونولی و نگاهی واقعگرایانه به آینده هوش مصنوعی است. 🤖
🎧 نسخه صوتی کتاب در اسپاتیفای در دسترس است. مطالعه آن به علاقهمندان فناوری، سیاست و آینده پیشنهاد میشود. 📖۱۴۰۴/۳/۱۲ ۲۰:۳۰:۳۳ -
Anthropic قابلیت مکالمه صوتی را به چتبات Claude اضافه کرد
🗣️ شرکت Anthropic حالت Voice Mode را برای چتبات Claude در نسخه موبایل فعال کرد! کاربران حالا میتوانند با Claude گفتگوهای صوتی انجام دهند و پاسخها را با صدا بشنوند. 🎧📱
این قابلیت فعلاً به زبان انگلیسی و در حالت آزمایشی عرضه شده و امکان سوییچ بین متن و صدا، انتخاب از بین ۵ صدای مختلف و دیدن خلاصه گفتگو را فراهم میکند. 🔄📝۱۴۰۴/۳/۸ ۰۲:۵۷:۱۸ -
هوش مصنوعی، ناشر کتابهای خیالی در روزنامه معتبر!
📚 روزنامه آمریکایی Chicago Sun-Times که یکی از رسانههای قدیمی و معتبر شهر شیکاگو است، اخیراً با انتشار یک «فهرست کتابهای تابستانی» جنجال بهپا کرد، چون بسیاری از کتابهای معرفیشده اصلاً واقعی نبودند! 🤯📖
این فهرست توسط هوش مصنوعی تهیه شده بود و شامل عناوینی جعلی بود که به نویسندگان معروف نسبت داده شدهاند، اما وجود خارجی ندارند. 🤖❌
روزنامه اعلام کرد این لیست توسط تحریریه رسمی تهیه نشده و در حال بررسی ماجراست. این اتفاق نشان میدهد که حتی رسانههای باسابقه نیز ممکن است قربانی اشتباهات محتوای تولیدشده با AI شوند. ⚠️📰۱۴۰۴/۳/۶ ۰۲:۵۳:۱۸ -
آمازون با خلاصههای صوتی هوشمند، خرید را متحول میکند
🛒 آمازون در اپلیکیشن Amazon Shopping قابلیتی جدید به نام خلاصه صوتی محصولات را آزمایش میکند! 🎧🤖 با زدن دکمه “Hear the highlights” در صفحه برخی محصولات، میتوانید توضیحاتی صوتی درباره ویژگیها، نظرات کاربران و اطلاعات وب بشنوید. 🗣️📱
این صداها توسط هوش مصنوعی و به سبک مکالمهای تولید شدهاند تا خرید راحتتر و سریعتری داشته باشید، حتی وقتی مشغول کار دیگری هستید. ⏳🧠
فعلاً فقط برای برخی کاربران آمریکایی فعال است، اما آمازون قصد دارد بهزودی آن را گسترش دهد. 🌍🛍️۱۴۰۴/۳/۵ ۱۴:۴۰:۳۶ -
Google Meet حالا با ترجمه زنده گفتار؛ زبان دیگر مانع نیست
🌍 گوگل در رویداد I/O 2025 اعلام کرد که قابلیت «ترجمه گفتار بهصورت زنده» را به Google Meet اضافه کرده است 🗣️ این ویژگی با کمک مدل صوتی پیشرفته DeepMind، امکان گفتوگو با افراد به زبانهای مختلف را در زمان واقعی فراهم میکند، آن هم با حفظ لحن، صدا و احساسات طرف مقابل 🎧💬
مثلاً نوههای انگلیسیزبان میتوانند با مادربزرگ اسپانیاییزبانشان راحت صحبت کنند یا شرکتهای بینالمللی جلسات چندزبانه برگزار کنند، بدون نیاز به مترجم 🌐👵🏢
صدا با تأخیر بسیار کم ترجمه میشود و صدای اصلی شخص نیز بهصورت کمرنگ در پسزمینه شنیده میشود 🎙️🔊۱۴۰۴/۳/۱ ۰۱:۱۶:۵۵ -
آزادسازی خرید کتاب صوتی اسپاتیفای در آیفون
🎧📚 اسپاتیفای اعلام کرد که کاربران آیفون در آمریکا اکنون میتوانند کتابهای صوتی را مستقیماً درون اپلیکیشن خریداری کنند. 🎶
این تغییر پس از حکم دادگاه آمریکا که اپل را از دریافت کارمزد خریدهای خارج از اپ استور منع کرد، اعمال شد. ⚖️
اسپاتیفای در سال ۲۰۲۲ امکان خرید کتابهای صوتی را به دلیل قوانین سختگیرانه اپل حذف کرده بود، اما اکنون این محدودیت برطرف شده است. ✅۱۴۰۴/۲/۳۱ ۱۷:۱۲:۴۲ -
موسیقی در دستان هوش مصنوعی با Stable Audio Open Small
🚀 Stability AI از مدل صوتی هوش مصنوعی Stable Audio Open Small رونمایی کرد. 🎶🤖 این مدل روی گوشیهای هوشمند هم کار میکند و در کمتر از ۸ ثانیه صدا تولید میکند. 📱
✅ برخلاف دیگر مدلها، فقط از آهنگهای رایگان برای آموزش استفاده کرده و نگرانی کپیرایت ندارد.
🔊 این مدل تنها از متن انگلیسی پشتیبانی میکند و مناسب تولید افکتهای صوتی و نمونههای کوتاه است. 🎧۱۴۰۴/۲/۲۹ ۱۳:۰۲:۱۵ -
Alexa+ در سراشیبی ناکامی
🚨 سرویس هوش مصنوعی جدید Alexa+ آمازون با مشکلاتی در دسترسی کاربران مواجه شده است.
با وجود اعلام آمازون مبنی بر دسترسی صدها هزار کاربر، شواهد عمومی از کاربران واقعی Alexa+ بسیار کم است. ❌
Alexa+ که با قابلیتهای جدید هوش مصنوعی طراحی شده، قرار بود دستیار صوتی آمازون را احیا کند، اما کاربران از سرعت پایین و گاهی اطلاعات نادرست شکایت دارند. ⚡🤖۱۴۰۴/۲/۲۸ ۱۹:۲۸:۳۷ -
هوش مصنوعی متا زیر تیغ عدالت؛ آیا بازار کتاب نابود میشود؟
⚖️ در دادگاهی در آمریکا، استفاده متا از کتابهای نویسندگان معروف برای آموزش مدل LLaMA بدون اجازه قانونی زیر ذرهبین رفت. قاضی گفت این مدل میتواند میلیاردها محتوای رقیب تولید کند و بازار آثار اصلی را نابود سازد. متا ادعا میکند استفادهاش منصفانه بوده، اما دادگاه در حال بررسی آثار واقعی این اقدام بر حقوق نویسندگان است. این پرونده بخشی از موج شکایتهای بزرگ علیه غولهای هوش مصنوعی است. ⚠️
۱۴۰۴/۲/۱۳ ۰۲:۱۲:۴۲ -
گوگل قابلیت صوتیسازی سند با هوش مصنوعی را به ۷۶ زبان جدید گسترش داد
گوگل قابلیت «Audio Overviews» در NotebookLM را که پادکستهایی هوش مصنوعیمحور از اسناد کاربران تولید میکند، به ۷۶ زبان جدید گسترش داده است. کاربران اکنون میتوانند زبان تولید پادکستها را خودشان انتخاب کنند، که امکان تولید محتوای چندزبانه یا مطالب آموزشی شخصیسازیشده را فراهم میکند. این ابزار برای مثال به دانشآموزان کمک میکند که خلاصه محتوای منابع مختلف را به زبان دلخواه خود گوش دهند. زبانهای جدید شامل فارسی، عربی، فرانسوی، چینی، ترکی، اسپانیایی، و بسیاری دیگر میشود.
۱۴۰۴/۲/۱۱ ۰۹:۴۵:۱۴



