-
مدل GPT-5 Pro از راه رسید؛ دقیقتر، عمیقتر و آماده برای صنایع مالی و پزشکی
OpenAI در رویداد Dev Day از مدلهای جدید خود رونمایی کرد؛ از جمله GPT-5 Pro برای پردازش عمیقتر متن، مدل ویدیوساز Sora 2 و مدل صوتی کوچکتر و ارزانتر gpt-realtime mini. این بهروزرسانیها برای جذب توسعهدهندگان و ساخت اپلیکیشن در ChatGPT ارائه شدهاند. 💡.
مدل GPT-5 Pro برای حوزههایی مثل مالی، حقوقی و پزشکی طراحی شده و دقت و قدرت استدلال بالاتری دارد. سم آلتمن، مدیرعامل OpenAI، گفت تعامل صوتی بهزودی یکی از روشهای اصلی ارتباط با هوش مصنوعی خواهد شد. 🎙️
مدل صوتی gpt-realtime mini با پشتیبانی از گفتوگوی زنده و کیفیت بالا، ۷۰٪ ارزانتر از مدل قبلی است. 🔊.
مدل Sora 2 نیز اکنون برای توسعهدهندگان در API در دسترس است و ویدیوهای واقعی با صدا و جلوههای هماهنگ تولید میکند. 🎬
اپلیکیشن Sora هم رقیب TikTok است و به کاربران امکان میدهد با یک دستور متنی، ویدیوهای کوتاه بسازند و به اشتراک بگذارند.۱۴۰۴/۷/۱۶ ۰۱:۰۷:۰۵ -
اپل برای تقویت Siri به سراغ هوش مصنوعی گوگل رفت!
بلومبرگ گزارش داد اپل قصد دارد برای نسخه جدید دستیار صوتی «سیری» (Siri) ، از مدل هوش مصنوعی شرکت گوگل یعنی Gemini استفاده کند. این مدل تا زمان آمادهشدن سیستم اختصاصی اپل، بهصورت موقت در سیری به کار گرفته میشود. 💬
بهگفتهی منابع آگاه، دو شرکت در حال نهاییکردن قراردادی هستند که براساس آن اپل سالانه حدود یک میلیارد دلار به گوگل برای استفاده از این فناوری پرداخت میکند. این مدل پیچیدگی بسیار بیشتری نسبت به سیستمهای فعلی اپل دارد و میتواند توانایی سیری را در انجام درخواستهای چندمرحلهای بهبود دهد. 🤖
در این همکاری، فناوری جستوجوی گوگل وارد سیستمعاملهای اپل نخواهد شد و فقط به بهبود عملکرد سیری محدود میشود. اپل پیشتر اعلام کرده بود که ارتقای هوش مصنوعی سیری تا سال ۲۰۲۶ به تعویق افتاده است. ⏳
این تصمیم در حالی اتخاذ میشود که گوگل و آمازون پیشتر نسخههای هوشمندتر از دستیارهای خود را عرضه کردهاند و اپل با تغییرات مدیریتی تلاش دارد دوباره در رقابت هوش مصنوعی پیشتاز شود. 🚀۱۴۰۴/۸/۱۶ ۰۰:۵۱:۰۳ -
نوآوری در هوش مصنوعی صوتی همچنان ادامه دارد
مدیرعامل ElevenLabs (استارتاپ فعال در حوزه هوش مصنوعی صوتی) در کنفرانس TechCrunch Disrupt 2025 اعلام کرد مدلهای هوش مصنوعی در چند سال آینده به فناوریهای عمومی و در دسترس همه تبدیل خواهند شد. 🤖
او گفت تمرکز فعلی شرکت بر بهبود مدلهای صوتی اختصاصی است، زیرا کیفیت و طبیعی بودن صدا هنوز چالشی اساسی است. 🎧 بهگفته او، در یک تا دو سال آینده مدلهای چندوجهی که صدا، تصویر و متن را همزمان تولید میکنند، رشد زیادی خواهند داشت؛ مانند مدل Veo 3 گوگل. 🧠
شرکت قصد دارد با همکاریهای جدید و بهرهگیری از فناوریهای متنباز، میان توسعه مدلها و کاربردهای واقعی تعادل ایجاد کند تا ارزش بلندمدتی مشابه ترکیب نرمافزار و سختافزار در اپل بسازد. 🍏🚀
محصولات این شرکت در پلتفرمهایی مانند دوبله ویدیو، پادکست، بازیهای ویدئویی، کتابهای صوتی و محتوای آموزشی استفاده میشوند.۱۴۰۴/۸/۹ ۱۰:۱۹:۰۲ -
اسپیکر ۳۶۰ درجه گوگل؛ نسل تازهای از هوش مصنوعی خانگی
گوگل پس از پنج سال، نسل جدید اسپیکر هوشمند خود با نام Google Home Speaker را معرفی کرد. 🔊 این مدل با پردازنده اختصاصی برای اجرای Gemini AI طراحی شده تا پاسخها سریعتر و طبیعیتر باشند. 🧠 ویژگی Gemini Live مکالمه بدون گفتن «Hey Google» را ممکن کرده و در کارهایی مانند خرید، آشپزی و کنترل وسایل خانه کمک میکند. 🍳🏠 اسپیکر میتواند از طریق سیستم هوشمند خانه، چراغها را با فرمان صوتی خاموش یا روشن کند و حتی دستوراتی مانند «تمام چراغها را خاموش کن جز یکی» را انجام دهد. 💡این مدل صدای ۳۶۰ درجه دارد و میتوان دو دستگاه را برای صدای استریو جفت کرد. 🎶
طراحی آن شامل حلقه نوری در پایین و چهار رنگ جدید است. 🌿🎨
قیمت دستگاه ۱۰۰ دلار بوده و عرضه آن در بهار ۲۰۲۶ انجام میشود. 🗓️۱۴۰۴/۷/۱۷ ۰۸:۱۵:۵۵ -
صدای شفاف در سرعت ۳۲۰ کیلومتر؛ فرمول یک روی موج نوآوری Hance
استارتاپ نروژی Hance نرمافزار پردازش صدایی ساخته که بسیار کوچک و سریع است و توجه شرکتهایی مثل Intel و Riedel Communications (تأمینکننده رسمی رادیوهای فرمول یک) را جلب کرده است. این شرکت تنها ۱۰ کارمند دارد، اما توانسته مدلهای پردازش خود را به حجم بسیار پایین ۲۴۲ کیلوبایت برساند. این یعنی پردازش صدا روی همان دستگاه و در لحظه انجام میشود و دیگر نیازی به فضای ابری نیست. 🎧🚀
فناوری Hance میتواند نویز، پژواک و صداهای مزاحم را حذف کند و وضوح صدا را تنها با ۱۰ میلیثانیه تأخیر بالا ببرد. همین باعث شده رادیوهای فرمول یک و حتی بخشهای امنیتی و دفاعی از آن استقبال کنند. همکاری با اینتل هم باعث شده این فناوری روی تراشههای جدید، از جمله «واحدهای پردازش عصبی»، اجرا شود. 💻⚡۱۴۰۴/۷/۱۰ ۰۱:۵۷:۳۴ -
همان قیمت، امکانات بیشتر! AirPods Pro 3 در مقایسه با Pro ۲
اپل از ایرپادز پرو ۳ رونمایی کرده؛ هدفونی که نسبت به نسل قبل پیشرفت زیادی داشته است. قابلیت حذف نویز فعال (ANC) در این مدل دو برابر قویتر از ایرپادز پرو ۲ عمل میکند و سریهای فومی جدید هم باعث میشوند صداهای مزاحم بیشتری گرفته شوند. 🎧🔇
کیفیت صدا نیز ارتقا یافته و با فناوری جدید EQ تطبیقی، باس قویتر و صدای فراگیرتری ارائه میشود. باتری هم بهبود یافته و حالا با ANC روشن تا ۸ ساعت و با حالت شفافیت تا ۱۰ ساعت شارژدهی دارد؛ یعنی حدود یکسوم بیشتر از نسل قبل. 🔋🎶
ایرپادز پرو ۳ امکانات تازهای مثل اندازهگیری ضربان قلب و ترجمه زنده مکالمات را هم به همراه دارد. همچنین اپل با بیش از ۱۰ هزار اسکن گوش و ۱۰۰ هزار ساعت تحقیق، طراحی سریها را بازبینی کرده و تعداد سایزها را از چهار به پنج افزایش داده تا راحتی بیشتری فراهم شود. 🩺🌍
با وجود همه این تغییرات، قیمت همچنان همان ۲۵۰ دلار نسل قبل باقی مانده است؛ یعنی قابلیتهای بیشتر با همان هزینه. ✅💵۱۴۰۴/۶/۲۰ ۱۰:۰۱:۲۸ -
تیکتاک به کاربرانش امکان ارسال پیامهای صوتی میدهد
تیکتاک قابلیتهای جدیدی برای پیامهای خصوصی معرفی کرد؛ از این پس کاربران میتوانند یادداشت صوتی ۶۰ ثانیهای و تا ۹ عکس یا ویدئو در چتهای فردی و گروهی ارسال کنند. این تغییرات، تجربه پیامرسانی در تیکتاک را مشابه واتساپ و اینستاگرام میکند. 🎙️📷
برای حفظ امنیت، ارسال عکس یا ویدئو بهعنوان اولین پیام ممکن نیست و محتوای نامناسب بهطور خودکار مسدود میشود. این قابلیتها بخشی از برنامه تیکتاک برای تقویت ابزارهای ارتباطی پس از افزودن چتهای گروهی و اتاقهای گفتگو است. ✅🚀۱۴۰۴/۶/۹ ۱۰:۲۵:۵۳ -
گوگل، NotebookLM را به 80 زبان گسترش داد
گوگل اعلام کرد قابلیت Video Overviews در ابزار NotebookLM اکنون از ۸۰ زبان از جمله فارسی، فرانسوی، آلمانی، اسپانیایی و ژاپنی پشتیبانی میکند. این ویژگی به کاربران امکان میدهد یادداشتها، فایلهای PDF و تصاویر خود را به ویدیوهای آموزشی تبدیل کنند؛ قابلیتی که پیشتر فقط برای زبان انگلیسی فعال بود. 🎥🌍
همچنین قابلیت Audio Overviews ارتقا یافته و خلاصههای صوتی در زبانهای غیرانگلیسی اکنون جزئیات بیشتری ارائه میدهند. کاربران میتوانند بسته به نیاز، نسخه کوتاه یا کامل خلاصهها را دریافت کنند. 🎧📑۱۴۰۴/۶/۵ ۰۷:۴۹:۳۵ -
چتبات هوش مصنوعی شکست خورد؛ بانک استرالیا کارمندان اخراجشده را بازگرداند!
بانک Commonwealth استرالیا ماه گذشته ۴۵ کارمند خدمات مشتری را با هدف جایگزینی با یک چتبات صوتی اخراج کرد، اما بهدلیل افزایش تماسها و ناکارآمدی سیستم مجبور شد آنها را بازگرداند. اتحادیه کارکنان بانکی اعلام کرد برخلاف ادعای بانک، حجم تماسها کاهش نیافته و حتی مدیران مجبور به پاسخگویی شدهاند. 🤖📞
بانک اعتراف کرد تصمیم اولیه اشتباه بوده و نقش کارکنان همچنان ضروری است. اتحادیه این عقبنشینی را یک پیروزی دانست، هرچند کارکنان با استرس و آسیب زیادی روبهرو شدند. ✅👥
این اتفاق نشان میدهد جایگزینی عجولانه نیروی انسانی با هوش مصنوعی همچنان پرریسک است؛ تحقیقی از MIT نیز تأیید کرده که تاکنون ۹۵٪ پروژههای آزمایشی هوش مصنوعی در شرکتها شکست خوردهاند. 📊⚡۱۴۰۴/۶/۳ ۱۲:۱۴:۰۵ -
اپل در حال توسعه Siri جدید با هوش مصنوعی
اپل در حال توسعه Siri جدید مبتنی بر هوش مصنوعی است که میتواند تنها با فرمان صوتی، کارهایی مانند جستجو، ویرایش و ارسال عکس، خرید آنلاین، ورود به حسابها و کنترل کامل اپلیکیشنها را انجام دهد؛ قابلیتی که تجربه کاربری را در تمام دستگاههای اپل دگرگون میکند. 🎙️📱
این پروژه که اولویت اصلی اپل است، بهار آینده همراه با بازسازی زیرساخت سیری عرضه میشود، هرچند چالشهایی مانند پشتیبانی از اپلیکیشنهای مختلف و دقت بالا در حوزههای حساس وجود دارد. موفقیت در این طرح میتواند اپل را به رهبر موج جدید هوش مصنوعی بدل کند، اما شکست آن ممکن است کاربران را به سمت رقبایی چون OpenAI سوق دهد. ✅🚀۱۴۰۴/۵/۲۲ ۰۳:۳۱:۵۸ -
متا ۲۰۰ میلیون دلار برای جذب استعداد اپل هزینه کرد!
🔹 متا با صرف ۲۰۰ میلیون دلار برای جذب یک متخصص هوش مصنوعی از اپل با نام «رومینگ پنگ» (Ruoming Pang) و استخدام چندین نفر از OpenAI، تلاش دارد دستیار صوتی عینکهای هوشمند خود را ارتقا دهد. ✅🕶️
هدف متا، بهبود تجربه کار با عینکهای Ray-Ban با استفاده از مدلهای زبانی پیشرفته است؛ چون این دستگاهها فاقد نمایشگرند و تعامل با آنها به عملکرد دستیار صوتی وابسته است. ✅🤖
این رویکرد میتواند متا را در رقابت عینکهای هوشمند از رقبایی مانند اپل جلو بیندازد. ✅🚀۱۴۰۴/۴/۲۳ ۱۲:۱۷:۵۶ -
تحول بزرگ در سیری: اپل به دنبال همکاری با OpenAI و Anthropic
اپل در حال بررسی استفاده از مدلهای هوش مصنوعی OpenAI یا Anthropic برای ارتقای دستیار صوتی سیری است؛ اقدامی که نشاندهنده تغییر راهبرد از مدلهای داخلی به راهکارهای بیرونی است. 🤖
گزارش بلومبرگ میگوید مذاکرات با این شرکتها برای اجرای مدلها روی زیرساخت ابری اپل آغاز شده، اما هنوز تصمیم نهایی گرفته نشده است. ☁️
این در حالیست که اپل بهروزرسانیهای سیری را تا سال ۲۰۲۶ به تعویق انداخته و همزمان ابزارهای هوش مصنوعی خود و OpenAI را در اختیار توسعهدهندگان قرار داده است. 🛠️۱۴۰۴/۴/۱۲ ۰۱:۰۴:۴۱ -
ایرپاد جدید اپل با ضبط صدای استودیویی و کنترل دوربین از راه رسید!
اپل در کنفرانس WWDC 2025 اعلام کرد که ایرپادهای جدید به دو قابلیت مهم مجهز میشوند: ضبط صدای حرفهای و کنترل دوربین با لمس ایرپاد. 🎧
با استفاده از چیپ H2، میکروفونهای پیشرفته و پردازش هوشمند صدا، کاربران میتوانند حتی در محیطهای شلوغ، صدایی شفاف و طبیعی ضبط کنند یا تماسهای باکیفیتتری داشته باشند. 🎙️
همچنین با نگهداشتن ساقه ایرپاد، میتوان دوربین آیفون یا اپهای دوربین دیگر را فعال کرد و بهراحتی عکس یا ویدیو گرفت؛ قابلیتی که برای تولید محتوا در شبکههای اجتماعی بسیار کاربردی است. 📸
این قابلیتها به زودی در AirPods 4، نسخه دارای حذف نویز، و AirPods Pro 2 در دسترس خواهند بود. ✅۱۴۰۴/۳/۲۱ ۰۲:۴۵:۳۷ -
ChatGPT با لحنی انسانیتر از همیشه
قابلیت گفتوگوی صوتی در ChatGPT با ارتقاء جدیدی همراه شده که صدای آن را طبیعیتر، روانتر و احساسیتر از قبل میکند. 🎙️
بهگفته OpenAI، نسخه جدید «صدای پیشرفته» با لحن واقعیتر، مکثهای طبیعی، تأکید مناسب و بیان دقیقتر احساساتی مانند همدلی یا طعنه طراحی شده است. 🧠
ویژگی ترجمه زنده نیز بهبود یافته و اکنون کاربران میتوانند بدون وقفه، گفتوگوهای چندزبانه را ادامه دهند تا زمانی که بخواهند زبان را تغییر دهند یا متوقف کنند. 🌍
این قابلیت برای همه کاربران سرویس پولی در تمامی پلتفرمها فعال است، هرچند ممکن است گاهی افت کیفیت صوتی یا خطاهای محدود مانند صداهای غیرمنتظره یا موسیقی پسزمینه رخ دهد. ⚠️۱۴۰۴/۳/۲۰ ۱۸:۲۷:۱۹ -
Soundcore Boom 3i؛ اسپیکر مقاوم و شناور انکر
🔊 انکر (Anker) از اسپیکر بلوتوثی مقاوم Boom 3i رونمایی کرده که روی آب شناور میماند و صدای شفاف پخش میکند. 🌊
🧂 در برابر آب شور تا ۲ سال بدون خوردگی دوام میآورد و در برابر سقوط، گردوغبار و غوطهوری در آب مقاوم است. 💥
🔋 با توان ۵۰ وات، صدای ۹۸ دسیبل و ۱۶ ساعت شارژ، مناسب مهمانیها و ماجراجوییهاست. 🎉
🚨 دارای آژیر اضطراری، تقویت صدا و قابلیت تمیز کردن خود از شن و خاک است. 📢
💵 این اسپیکر ۱۸۹ دلار قیمت گذاری شده است و برای شرایط سخت گزینهای جدی بهحساب میآید.۱۴۰۴/۳/۱۴ ۰۲:۳۳:۱۶ -
Anthropic قابلیت مکالمه صوتی را به چتبات Claude اضافه کرد
🗣️ شرکت Anthropic حالت Voice Mode را برای چتبات Claude در نسخه موبایل فعال کرد! کاربران حالا میتوانند با Claude گفتگوهای صوتی انجام دهند و پاسخها را با صدا بشنوند. 🎧📱
این قابلیت فعلاً به زبان انگلیسی و در حالت آزمایشی عرضه شده و امکان سوییچ بین متن و صدا، انتخاب از بین ۵ صدای مختلف و دیدن خلاصه گفتگو را فراهم میکند. 🔄📝۱۴۰۴/۳/۸ ۰۲:۵۷:۱۸ -
آمازون با خلاصههای صوتی هوشمند، خرید را متحول میکند
🛒 آمازون در اپلیکیشن Amazon Shopping قابلیتی جدید به نام خلاصه صوتی محصولات را آزمایش میکند! 🎧🤖 با زدن دکمه “Hear the highlights” در صفحه برخی محصولات، میتوانید توضیحاتی صوتی درباره ویژگیها، نظرات کاربران و اطلاعات وب بشنوید. 🗣️📱
این صداها توسط هوش مصنوعی و به سبک مکالمهای تولید شدهاند تا خرید راحتتر و سریعتری داشته باشید، حتی وقتی مشغول کار دیگری هستید. ⏳🧠
فعلاً فقط برای برخی کاربران آمریکایی فعال است، اما آمازون قصد دارد بهزودی آن را گسترش دهد. 🌍🛍️۱۴۰۴/۳/۵ ۱۴:۴۰:۳۶ -
کتاب صوتی ملانیا ترامپ با صدای مصنوعی منتشر شد
📚 ملانیا ترامپ نسخه صوتی کتاب خاطرات خود را با صدای مصنوعی شبیهسازیشده خودش منتشر کرد و آن را «آغاز عصر جدید نشر» نامید. 🎙️🤖
این کتاب با همکاری شرکت ElevenLabs ساخته شده و فعلاً به زبان انگلیسی در سایت شخصی او در دسترس است، اما قرار است به بیش از ۳۰ زبان دیگر نیز منتشر شود. 🌍📕
هرچند کتاب چاپی در لیست پرفروشها قرار گرفت، فقط ۸۵ هزار نسخه در هفته اول فروخت؛ رقمی بسیار کمتر از کتاب میشل اوباما. 📉📖
ملانیا در کتاب از زندگی شخصیاش میگوید و موضعی موافق با حق سقط جنین اتخاذ میکند. ⚖️🗣️
با وجود انتقادها از نبود احساس انسانی در صدای هوش مصنوعی، ElevenLabs این پروژه را نقطهعطفی در کتابهای صوتی میداند. 🚀🔊۱۴۰۴/۳/۵ ۰۲:۴۹:۲۱ -
Google Meet حالا با ترجمه زنده گفتار؛ زبان دیگر مانع نیست
🌍 گوگل در رویداد I/O 2025 اعلام کرد که قابلیت «ترجمه گفتار بهصورت زنده» را به Google Meet اضافه کرده است 🗣️ این ویژگی با کمک مدل صوتی پیشرفته DeepMind، امکان گفتوگو با افراد به زبانهای مختلف را در زمان واقعی فراهم میکند، آن هم با حفظ لحن، صدا و احساسات طرف مقابل 🎧💬
مثلاً نوههای انگلیسیزبان میتوانند با مادربزرگ اسپانیاییزبانشان راحت صحبت کنند یا شرکتهای بینالمللی جلسات چندزبانه برگزار کنند، بدون نیاز به مترجم 🌐👵🏢
صدا با تأخیر بسیار کم ترجمه میشود و صدای اصلی شخص نیز بهصورت کمرنگ در پسزمینه شنیده میشود 🎙️🔊۱۴۰۴/۳/۱ ۰۱:۱۶:۵۵ -
آزادسازی خرید کتاب صوتی اسپاتیفای در آیفون
🎧📚 اسپاتیفای اعلام کرد که کاربران آیفون در آمریکا اکنون میتوانند کتابهای صوتی را مستقیماً درون اپلیکیشن خریداری کنند. 🎶
این تغییر پس از حکم دادگاه آمریکا که اپل را از دریافت کارمزد خریدهای خارج از اپ استور منع کرد، اعمال شد. ⚖️
اسپاتیفای در سال ۲۰۲۲ امکان خرید کتابهای صوتی را به دلیل قوانین سختگیرانه اپل حذف کرده بود، اما اکنون این محدودیت برطرف شده است. ✅۱۴۰۴/۲/۳۱ ۱۷:۱۲:۴۲ -
هوش مصنوعی، راهکار جدید Audible برای گسترش کتابهای صوتی
🎧📚 Audible، سرویس کتاب صوتی آمازون، با همکاری ناشران، کتابهای چاپی و الکترونیکی را به کتابهای صوتی با صدای هوش مصنوعی تبدیل میکند! 🚀🤖 این قابلیت با انتخاب از بین ۱۰۰ صدای هوش مصنوعی به زبانهای مختلف، از جمله انگلیسی، فرانسوی، اسپانیایی و ایتالیایی، ارائه میشود. 🌍🔊
Audible همچنین قابلیت ترجمه هوش مصنوعی متن به متن و گفتار به گفتار را بهزودی فعال میکند. اما برخی ناشران نگران کاهش کیفیت کتابهای صوتی با صدای هوش مصنوعی هستند. 📉💬
این اقدام با هدف گسترش سریع کاتالوگ کتابهای صوتی و رقابت با اپل و اسپاتیفای انجام میشود.۱۴۰۴/۲/۳۰ ۰۵:۰۶:۰۶ -
موسیقی در دستان هوش مصنوعی با Stable Audio Open Small
🚀 Stability AI از مدل صوتی هوش مصنوعی Stable Audio Open Small رونمایی کرد. 🎶🤖 این مدل روی گوشیهای هوشمند هم کار میکند و در کمتر از ۸ ثانیه صدا تولید میکند. 📱
✅ برخلاف دیگر مدلها، فقط از آهنگهای رایگان برای آموزش استفاده کرده و نگرانی کپیرایت ندارد.
🔊 این مدل تنها از متن انگلیسی پشتیبانی میکند و مناسب تولید افکتهای صوتی و نمونههای کوتاه است. 🎧۱۴۰۴/۲/۲۹ ۱۳:۰۲:۱۵ -
Alexa+ در سراشیبی ناکامی
🚨 سرویس هوش مصنوعی جدید Alexa+ آمازون با مشکلاتی در دسترسی کاربران مواجه شده است.
با وجود اعلام آمازون مبنی بر دسترسی صدها هزار کاربر، شواهد عمومی از کاربران واقعی Alexa+ بسیار کم است. ❌
Alexa+ که با قابلیتهای جدید هوش مصنوعی طراحی شده، قرار بود دستیار صوتی آمازون را احیا کند، اما کاربران از سرعت پایین و گاهی اطلاعات نادرست شکایت دارند. ⚡🤖۱۴۰۴/۲/۲۸ ۱۹:۲۸:۳۷ -
پادکسترها به شمارش پخش عمومی اسپاتیفای اعتراض کردند
🎧 اسپاتیفای هفته گذشته قصد داشت تعداد پخش همه پادکستها را عمومی کند، اما با مخالفت شدید سازندگان پادکست مواجه شد.
منتقدان معتقد بودند این اقدام باعث میشود پادکستهای کوچکتر شانسی برای جذب مخاطب نداشته باشند.
در نهایت اسپاتیفای عقبنشینی کرد و اعلام کرد فقط پادکستهای بالای ۵۰ هزار پخش، تعداد پخش آنها نمایش داده خواهد شد.
این تصمیم تلاشی برای ایجاد توازن بین پادکستهای بزرگ و کوچک است.۱۴۰۴/۲/۲۸ ۰۲:۴۴:۵۷ -
هدست Clio ریزر: نجاتدهنده گیمرهای طاس!
🎧 شرکت ریزر (Razer) با معرفی Clio، بالش صوتی جدید خود، تجربه گیمینگ را برای کاربرانی که به دنبال صدای باکیفیت بدون هدفون هستند، بهبود بخشیده است. این محصول بهویژه برای کاربرانی با پوست سر حساس یا سر بدون مو طراحی شده که در استفاده از هدفونهای معمولی با ناراحتی مواجه میشوند. 😎
Clio به پشت صندلی گیمینگ متصل شده و با دو اسپیکر ۴۳ میلیمتری و پشتیبانی از THX Spatial Audio، صدای فراگیر سهبعدی را مستقیماً به گوش کاربر منتقل میکند. این دستگاه از طریق بیسیم (۲.۴ گیگاهرتز Hyperspeed) یا بلوتوث متصل میشود و دارای سه حالت صوتی (بازی، فیلم و موسیقی) است. 🔊
این بالش صوتی از فوم حافظهدار ساخته شده و میتواند به اکثر صندلیهای گیمینگ با یک بند ساده نصب شود. عمر باتری آن تا ۱۴ ساعت است و از طریق USB-C نیز قابل استفاده است. 🔋۱۴۰۴/۲/۲۲ ۱۶:۳۳:۰۱ -
گوگل قابلیت صوتیسازی سند با هوش مصنوعی را به ۷۶ زبان جدید گسترش داد
گوگل قابلیت «Audio Overviews» در NotebookLM را که پادکستهایی هوش مصنوعیمحور از اسناد کاربران تولید میکند، به ۷۶ زبان جدید گسترش داده است. کاربران اکنون میتوانند زبان تولید پادکستها را خودشان انتخاب کنند، که امکان تولید محتوای چندزبانه یا مطالب آموزشی شخصیسازیشده را فراهم میکند. این ابزار برای مثال به دانشآموزان کمک میکند که خلاصه محتوای منابع مختلف را به زبان دلخواه خود گوش دهند. زبانهای جدید شامل فارسی، عربی، فرانسوی، چینی، ترکی، اسپانیایی، و بسیاری دیگر میشود.
۱۴۰۴/۲/۱۱ ۰۹:۴۵:۱۴ -
ورود هوش مصنوعی به منوی رستورانها
شرکت Yelp از دستیارهای صوتی هوش مصنوعی برای پاسخگویی تلفنی رستورانها و کسبوکارها رونمایی کرد. این سیستمها بدون نیاز به نصب پیچیده و API، از اطلاعات کسبوکار مثل پیام خوشآمد، راهنمای تلفظ و قوانین تماس استفاده میکنند. مثلاً میتوانند مشتری را به لیست انتظار اضافه کرده یا اطلاعات رزرو را بعد از تماس ارسال کنند.
امکان فیلتر تماسهای اسپم، تحلیل تماس و انتقال تماسهای پیچیده به انسان نیز وجود دارد. پس از هر تماس، گزارش، متن و فایل صوتی به کسبوکار داده میشود.۱۴۰۴/۲/۱۰ ۲۳:۲۱:۳۶ -
برند CMF از Nothing ایرپادهایی با سه مدل مختلف در رده قیمتی پایین معرفی کرد
برند CMF از شرکت Nothing سه مدل ایرپاد بیسیم جدید با نامهای Buds 2a، Buds 2 و Buds 2 Plus با قیمت های ۴۹ تا ۶۸ دلار معرفی کرده. هر سه مدل از حذف نویز فعال (ANC) پشتیبانی میکنند و طراحی ساده و اقتصادی دارند.
تفاوت اصلی این سه مدل در چند بخش است: عمر باتری (مدل Plus با ۱۴ ساعت بیشترین دوام را دارد)، کیفیت تماس صوتی (مدلهای بالاتر دارای میکروفونهای بیشتر و پردازش صوتی بهتر هستند)، و کیفیت صدا (مدلهای گرانتر از صدای فضایی ۳D پشتیبانی میکنند).
در زمینه حذف نویز، عملکرد مدل Plus نسبت به دو مدل ارزانتر بهتر است اما همچنان در برابر ایرپادهای گرانتر بازار حرفی برای گفتن ندارد.۱۴۰۴/۲/۱۰ ۱۱:۴۶:۳۲ -
نتفلیکس زیرنویس جدید خود را معرفی کرد
نتفلیکس قابلیت جدیدی به زیرنویسهای خود اضافه کرده که فقط دیالوگها را نشان میدهد و صداهایی مانند “در بسته شد” یا “تلفن زنگ زد” حذف شدهاند. این ویژگی که با انتخاب گزینه “English” بهجای “English (CC)” فعال میشود، برای کسانی طراحی شده که فقط میخواهند گفتوگوها را بخوانند و نیازی به اطلاعات صوتی دیگر ندارند. این نوع زیرنویس مکمل زیرنویسهای کامل ویژه ناشنوایان است. نتفلیکس اعلام کرده تقریباً نیمی از زمان تماشای کاربران در آمریکا با زیرنویس همراه است. این قابلیت فعلاً برای فصل جدید سریال “You” فعال شده و بهزودی در دیگر آثار اصلی نتفلیکس و به تمام زبانها ارائه خواهد شد.
۱۴۰۴/۲/۶ ۰۸:۱۷:۵۵ -
هوش مصنوعی عینکهای هوشمند متا به اروپا گسترش یافت
متا اعلام کرد که دستیار هوش مصنوعی خود را روی عینکهای هوشمند Ray-Ban در هفت کشور اروپایی دیگر فعال کرده است. کاربران در آلمان، اتریش، بلژیک، دانمارک، نروژ، سوئد و فنلاند اکنون میتوانند با دستیار صوتی Meta AI صحبت کرده و پاسخ سوالات عمومی خود را دریافت کنند.
این قابلیت ابتدا در آمریکا فعال شده بود، اما بهدلیل قوانین سختگیرانه اتحادیه اروپا در زمینه حفظ حریم خصوصی، ورود آن به اروپا با تأخیر مواجه شد.
قابلیتهای جدیدی نیز در راه است؛ از جمله ترجمه زنده و امکان پرسش از هوش مصنوعی درباره چیزهایی که کاربر با عینک میبیند. این ویژگیها از هفته آینده در کشورهای اروپایی پشتیبانیشده فعال میشوند.
هدف متا از این توسعه، جذب کاربران بیشتر و تقویت موقعیت خود در حوزه فناوریهای پوشیدنی و هوش مصنوعی است.۱۴۰۴/۲/۴ ۱۸:۲۹:۵۴



