استارتاپ Runway وارد بازار زیرساخت هوش مصنوعی شده است تا صرفاً برای ارائه بهترین مدل‌های هوش مصنوعی تلاش نکند. استارتاپ Runway از ابزار جدیدی به نام Media Router رونمایی کرده که به توسعه‌دهندگان کمک می‌کند بهترین مدل هوش مصنوعی برای تولید تصویر، ویدیو یا صوت را براساس معیارهایی مانند کیفیت، سرعت و هزینه انتخاب کنند. این شرکت می‌گوید ابزار جدید نخستین مسیریاب مدل هوش مصنوعی است که به‌طور اختصاصی برای ابزارهای مولد مدیا طراحی شده است.

Media Router از طریق پلتفرم توسعه‌دهندگان Runway Dev در دسترس قرار گرفته و علاوه‌بر مدل‌های اختصاصی Runway، امکان استفاده از مدل‌های شخص ثالث در حوزه تصویر، ویدیو و صوت را نیز فراهم می‌کند. به گفته «آنتونی ماجیو» (Anthony Maggio)، مدیر ارشد محصول Runway، این ابزار با هدف تبدیل شدن به ساده‌ترین راهکار برای توسعه‌دهندگان جهت استفاده از مدل‌های مختلف ساخته شده است.

معرفی این ابزار نشان‌دهنده تغییر مسیر Runway از یک شرکت فعال در زمینه تولید ویدیو با هوش مصنوعی به ارائه‌دهنده زیرساخت برای شرکت‌هایی است که از محتواهای AI در محصولات خود استفاده می‌کنند. شرکت‌هایی مانند ادوبی، کلودفلر، ElevenLabs، اکسپدیا، شاتراستاک و Quora می‌توانند از API این شرکت برای افزودن قابلیت تولید محتوا به محصولات خود استفاده کنند.



ادامه مطلب

دستاوردهای جدید Unitree در توسعه مدل‌های تجسم‌یافته، گامی کلیدی برای حضور ربات‌های هوشمند در محیط‌های خانگی و درمانی محسوب می‌شود. شرکت چینی Unitree از مدل هوش مصنوعی یکپارچه جدید خود به نام UnifoLM-OminiA-0.3 برای ربات‌های انسان‌نما رونمایی کرده است. این مدل امکان تعامل همه‌جانبه، استدلال لحظه‌ای، گفتگو و جابه‌جایی و دستکاری اجسام توسط کل بدن ربات را در یک سیستم واحد فراهم می‌کند. به گفته این شرکت، مدل مذکور با هدف استفاده در برنامه‌های مراقبت در منزل و سلامت طراحی شده است و به ربات‌ها اجازه می‌دهد به‌صورت خودمختار وظایفی مانند مرتب کردن اتاق‌ها، باز کردن کشوها و کمک به افراد در اطراف تخت‌های بیمارستانی را با پاسخ‌دهی به ورودی‌های صوتی، بصری و محیطی انجام دهند. Unitree اخیراً یک ربات انسان‌نمای نیم‌تنه ارزان‌قیمت نیز با قیمت پایه ۴,۲۹۰ دلار معرفی کرده بود تا فناوری رباتیک انسان‌نما را مقرون‌به‌صرفه‌تر و دسترس‌پذیرتر سازد.

UnifoLM-OminiA-0.3 یک مدل هوش مصنوعی تجسم‌یافته (Embodied AI) جدید است که به ربات‌های انسان‌نما کمک می‌کند تا طیف وسیعی از کارهای خانگی و مراقبتی را تنها با استفاده از یک سیستم کنترلی انجام دهند. این شرکت چینی می‌گوید سیستم جدید با ترکیب استدلال لحظه‌ای، گفتگو، ادراک همه‌جانبه و جابه‌جایی حرکتی کل بدن، به ربات‌ها امکان می‌دهد دستورات صوتی را درک کنند، اطلاعات بصری را تفسیر نمایند، در محیط اطراف خود مسیریابی کنند و بدون نیاز به مدل‌های مجزا برای هر کار، با اشیا تعامل داشته باشند. Unitree عملکرد این مدل را در قالب یک ویدیو و از طریق مجموعه‌ای از فعالیت‌های خانگی و مراقبتی به نمایش گذاشته است. در ویدیو، ربات انسان‌نما یک کوسن را برمی‌دارد و روی مبل می‌گذارد، رنگ‌ها را تشخیص می‌دهد، جعبه‌های دارو را می‌شمارد، داروی درخواستی را از قفسه برمی‌دارد و لباس‌ها را درون سبد رخت‌شویی مرتب می‌کند. این ربات همچنین بشقابی را داخل ماشین ظرف‌شویی قرار می‌دهد و ارتفاع تخت بیمارستانی را تنظیم می‌کند.

یکی از نکات برجسته این نمایش، قابلیت پاسخ‌دهی مدل درحین انجام کار است. در حین تنظیم تخت بیمارستان، کاربر به ربات دستور می‌دهد عملیات را متوقف کند؛ ربات نیز بلافاصله به این فرمان واکنش نشان داده و دست از کار می‌کشد. این موضوع تمرکز Unitree بر تعامل مداوم انسان و ربات و انطباق پویای آن با شرایط را نشان می‌دهد.

هرچند بسیاری از این وظایف فردی پیش‌تر توسط ربات‌های شرکت‌های دیگر انجام شده بود، Unitree اهمیت UnifoLM-OminiA-0.3 را در هماهنگ‌سازی کل این مسیر کاری از طریق یک مدل هوش مصنوعی واحد می‌داند. این سیستم درک زبان، ادراک بصری، شناسایی اشیا، تصمیم‌گیری، مسیریابی و کنترل حرکتی کامل بدن را در یک قالب یکپارچه جمع می‌کند تا حتی در صورت بروز تغییرات غیرمنتظره یا مداخله، عملکرد پایداری داشته باشد.



گوگل انتشار به‌روزرسانی جدیدی را برای هوش مصنوعی جمینای در Google Sheets آغاز کرده است که به این دستیار هوشمند اجازه می‌دهد تا خطاهای فرمول‌نویسی را تنها با یک کلیک تشخیص داده و آنها را برطرف کند. البته این قابلیت در صورتی در دسترس خواهد بود که مدیر Workspace شما، ویژگی «Gemini for Workspace» را فعال کرده باشد. این ویژگی جدید توانایی مدیریت و بررسی تقریباً همه چیز، از محاسبات پایه ریاضی گرفته تا محاسبات بسیار پیچیده را دارد.

بنابر اعلام گوگل، این ویژگی جدید توانایی مدیریت و بررسی تقریباً همه چیز، از محاسبات پایه ریاضی گرفته تا محاسبات بسیار پیچیده را دارد. این قابلیت حدود دو سال پس از آن معرفی شده که گوگل قابلیت پایه تولید فرمول با جمینای را به Sheets اضافه کرده بود.

برای ساخت یک فرمول با استفاده از جمینای در شیتس، ابتدا باید یک سند صفحه‌گسترده (Spreadsheet) را در کامپیوتر خود باز کرده و روی گزینه «Ask Gemini» در گوشه بالا سمت راست کلیک کنید. همچنین می‌توانید علامت مساوی (=) را در هر سلولی وارد کرده و از کلیدهای میانبر مانند Ctrl + Alt + G در ویندوز و کروم اواس، یا Command + Ctrl + G در سیستم‌عامل macOS استفاده کنید.



ادامه مطلب

شرکت گوگل ابزار جدیدی تحت عنوان «Select from Screen» (انتخاب از روی صفحه) را به مرورگر کروم اضافه کرده است که فرایند تعامل کاربران با هوش مصنوعی جمینای را متحول می‌کند. با استفاده از این ویژگی، کاربران می‌توانند محتواهای موجود در یک صفحه وب، مانند تصویر، نمودارها یا متن را انتخاب کنند و سپس درباره آن از جمینای سؤال کنند. این ابزار عملکردی مشابه قابلیت Circle to Search دارد و در نسخه ۱۴۹ مرورگر کروم عرضه شده است.

ین ابزار عملکردی مشابه قابلیت Circle to Search در سیستم‌عامل‌های موبایل دارد. هنگام فعال‌سازی این ابزار، تب فعلی مرورگر شما برجسته می‌شود و کاربر می‌تواند هر بخش، متن، تصویر یا نمودار موجود در صفحه را با ماوس انتخاب کند و مستقیماً سوال خود درباره آن را از جمینای بپرسد.

براساس اطلاعات منتشرشده، برای دسترسی به این ویژگی باید روی دکمه Ask Gemini در نوار بالایی مرورگر کروم کلیک کرد. سپس در پنل باز شده، با کلیک روی دکمه + و انتخاب گزینه Select from screen، ابزار فعال می‌شود. کاربران می‌توانند ابعاد کادر انتخاب‌شده را با کشیدن لبه‌های آن تغییر دهند یا کل کادر را روی صفحه جابه‌جا کنند. درصورت انتخاب اشتباه، امکان حذف کادر با کلیک روی علامت X در گوشه آن وجود دارد. همچنین با بستن کامل پنل جمینای در کروم، تمامی انتخاب‌های انجام‌شده پاک می‌شوند.

گوگل در صفحه راهنمای این قابلیت، سناریوهای مختلفی را برای استفاده از آن ارائه کرده است؛ این موارد شامل انتخاب چند محصول برای مقایسه آنها با یکدیگر و یافتن بهترین گزینه، کادربندی بخشی از یک نمودار یا متن پیچیده جهت دریافت توضیحات ساده‌تر و همچنین انتخاب یک شیء یا بخشی از صفحه برای بازطراحی و ایده‌پردازی تصویری می‌شود.

این قابلیت درحال‌حاضر در نسخه ۱۴۹ مرورگر کروم عرضه شده است و کاربران می‌توانند با مراجعه به بخش تنظیمات و سپس About Chrome، وضعیت به‌روزرسانی مرورگر خود را بررسی کنند.



OpenAI هم‌زمان با معرفی هاب زمان‌بندی تسک‌ها در ChatGPT، ویژگی خلاصه‌ساز روزانه Pulse را پس از یک سال فعالیت بازنشسته می‌کند.

شرکت OpenAI به‌روزرسانی جدیدی برای ChatGPT منتشر کرده که قابلیت زمان‌بندی تسک‌ها و وظایف را به شکلی برجسته‌تر در اختیار کاربران قرار می‌دهد. پیش از این نیز امکان محول کردن وظایف آینده به این هوش مصنوعی وجود داشت، اما اکنون فرایند مدیریت آنها بسیار ساده‌تر شده است.

با این آپدیت، کاربران در منوی کناری ChatGPT گزینه جدیدی به نام Scheduled را مشاهده خواهند کرد. این صفحه به عنوان یک هاب مرکزی عمل می‌کند و تمام وظایف فعال و زمان‌بندی‌شده را به همراه زمان دقیق اجرای آنها نمایش می‌دهد. کاربران می‌توانند از طریق این بخش، درخواست‌های آینده خود را ویرایش، متوقف یا به‌طور کامل حذف کنند. OpenAI اعلام کرده که زیرساخت این قابلیت نیز تقویت شده و اکنون تمام تسک‌ها با سرعت و پایداری بالاتری اجرا می‌شوند.

هنگام ثبت یک درخواست برای آینده، کاربر می‌تواند زمان دقیق اجرا را مشخص یا بازه‌های زمانی کلی‌تری مانند صبح، عصر یا شب را انتخاب کند. امکان تعریف «تسک‌های نظارتی» (Monitoring Tasks) نیز وجود دارد؛ به این صورت که ChatGPT می‌تواند در زمان‌های تعیین‌شده، به‌صورت خودکار در وب یا اپلیکیشن‌های متصل برای یافتن اطلاعات جدید جستجو کند.

این قابلیت درحال‌حاضر برای کاربران اشتراک‌های پلاس، پرو، بیزینس و Enterprise فعال شده است و هنوز مشخص نیست چه زمانی در دسترس کاربران نسخه رایگان قرار می‌گیرد. هم‌زمان با معرفی این هاب، OpenAI ویژگی Pulse را که سال گذشته برای ارائه خلاصه‌های روزانه شخصی‌سازی‌شده معرفی کرده بود، بازنشسته می‌کند. کاربران نسخه پرو تا ۱۴ روز آینده همچنان به Pulse دسترسی خواهند داشت و پس از آن باید از هاب زمان‌بندی جدید برای تولید خلاصه‌های خود استفاده کنند.



       مطالب قبلی >>


.: Weblog Themes By Pichak :.