🤖 حتی مدلهای AI هم «مشکلات شخصیتی» دارند!
جالب است که مدلهای مختلف هوش مصنوعی، فقط از نظر توانایی متفاوت نیستند؛ رفتار و سوگیریهای متفاوتی هم دارند.
🧠 طبق این تجربه، مدلهای Anthropic گاهی بیش از حد درباره خودشان صحبت میکنند؛ حتی وقتی وظیفه فقط کدنویسی یا تحلیل یک مسئله است!
در مقابل، ChatGPT و Grok معمولاً بیشتر روی انجام مستقیم کار تمرکز میکنند.
⚠️ اما ChatGPT در موضوعات مربوط به جنسیت، روابط و تفاوتهای زن و مرد گاهی پاسخهایی یکطرفه ارائه میدهد؛ پاسخهایی که به دلیل لحن علمی و استناد به تحقیقات، تشخیص سوگیری در آنها سختتر است.
😂 جالبتر اینکه حتی اگر سوگیری را به مدل گوشزد کنید، ممکن است آن را بپذیرد... و در گفتوگوی بعدی دوباره همان رفتار را تکرار کند!
📌 در نهایت یک نکته مهم وجود دارد:
مدلهای مختلف، شخصیتها و سوگیریهای متفاوتی دارند.
شاید در آینده علاوه بر تست هوش و ایمنی، برای مدلهای AI باید تست شخصیت هم بگیریم! 😄🤖
جالب است که مدلهای مختلف هوش مصنوعی، فقط از نظر توانایی متفاوت نیستند؛ رفتار و سوگیریهای متفاوتی هم دارند.
🧠 طبق این تجربه، مدلهای Anthropic گاهی بیش از حد درباره خودشان صحبت میکنند؛ حتی وقتی وظیفه فقط کدنویسی یا تحلیل یک مسئله است!
در مقابل، ChatGPT و Grok معمولاً بیشتر روی انجام مستقیم کار تمرکز میکنند.
⚠️ اما ChatGPT در موضوعات مربوط به جنسیت، روابط و تفاوتهای زن و مرد گاهی پاسخهایی یکطرفه ارائه میدهد؛ پاسخهایی که به دلیل لحن علمی و استناد به تحقیقات، تشخیص سوگیری در آنها سختتر است.
😂 جالبتر اینکه حتی اگر سوگیری را به مدل گوشزد کنید، ممکن است آن را بپذیرد... و در گفتوگوی بعدی دوباره همان رفتار را تکرار کند!
📌 در نهایت یک نکته مهم وجود دارد:
مدلهای مختلف، شخصیتها و سوگیریهای متفاوتی دارند.
شاید در آینده علاوه بر تست هوش و ایمنی، برای مدلهای AI باید تست شخصیت هم بگیریم! 😄🤖
Media is too big
VIEW IN TELEGRAM
🤯 ایلان ماسک: تمام کارخانههای تراشه جهان فقط ۲٪ نیاز ما را تأمین میکنند!
ایلان ماسک ادعا کرده ظرفیت تولید تراشه شرکتهایی مثل TSMC، Samsung و Micron در مجموع تنها حدود ۲٪ از نیاز مورد انتظار او را پوشش میدهد. 🧠⚡
به گفته او، حتی اگر تمام ظرفیت تولید این شرکتها خریداری شود، باز هم کافی نیست.
🏭 به همین دلیل ماسک از پروژه عظیم Terafab در تگزاس صحبت کرده؛ مجموعهای با مساحت حدود ۱۰۰ میلیون فوت مربع که هزینه فاز نخست آن حدود ۱۶.۸ میلیارد دلار اعلام شده است.
🎯 هدف؟ تولید حجم عظیمی از تراشه برای پاسخ به نیاز روبهرشد AI و دیتاسنترها.
📌 اگر این پروژه واقعاً به چنین مقیاسی برسد، دیگر رقابت فقط بر سر ساخت مدلهای هوش مصنوعی نیست؛ جنگ اصلی میتواند بر سر خود تراشهها باشد. 🔥
⚠️ البته اعداد و ادعاهای مطرحشده درباره «۲٪» و مقایسه ظرفیتها نیاز به بررسی مستقل دارند.
ایلان ماسک ادعا کرده ظرفیت تولید تراشه شرکتهایی مثل TSMC، Samsung و Micron در مجموع تنها حدود ۲٪ از نیاز مورد انتظار او را پوشش میدهد. 🧠⚡
به گفته او، حتی اگر تمام ظرفیت تولید این شرکتها خریداری شود، باز هم کافی نیست.
🏭 به همین دلیل ماسک از پروژه عظیم Terafab در تگزاس صحبت کرده؛ مجموعهای با مساحت حدود ۱۰۰ میلیون فوت مربع که هزینه فاز نخست آن حدود ۱۶.۸ میلیارد دلار اعلام شده است.
🎯 هدف؟ تولید حجم عظیمی از تراشه برای پاسخ به نیاز روبهرشد AI و دیتاسنترها.
📌 اگر این پروژه واقعاً به چنین مقیاسی برسد، دیگر رقابت فقط بر سر ساخت مدلهای هوش مصنوعی نیست؛ جنگ اصلی میتواند بر سر خود تراشهها باشد. 🔥
⚠️ البته اعداد و ادعاهای مطرحشده درباره «۲٪» و مقایسه ظرفیتها نیاز به بررسی مستقل دارند.
⚠️ ChatGPT
یک کاربر را به FBI گزارش کرد!
طبق این گزارش، یک کارمند ۲۵ ساله Goldman Sachs در گفتگو با ChatGPT درباره مشکلات رابطهاش صحبت کرده و در بخشی از مکالمه، افکار و خیالپردازیهای خشونتآمیز مطرح کرده است.
🚨 این گفتگو توسط سیستمهای ایمنی پرچمگذاری و در ادامه به FBI ارجاع شده است.
مقامات نیز با استناد به این مکالمات برای دریافت مجوز بازرسی اقدام کردند. این فرد در نهایت به اتهاماتی از جمله تهدید کتبی به قتل و تعقیب تشدیدشده محکوم شد و ۸ سال تحت نظارت قضایی قرار گرفت.
📌 این ماجرا یک سؤال جدی ایجاد میکند:
آیا گفتوگو با یک AI واقعاً خصوصی است، یا در شرایط خاص میتواند به اطلاعاتی تبدیل شود که در اختیار مراجع قانونی قرار بگیرد؟ ⚠️
البته جزئیات حقوقی و اینکه دقیقاً چه اطلاعاتی و تحت چه فرایندی به مقامات منتقل شده، برای قضاوت درباره این پرونده اهمیت زیادی دارد.
یک کاربر را به FBI گزارش کرد!
طبق این گزارش، یک کارمند ۲۵ ساله Goldman Sachs در گفتگو با ChatGPT درباره مشکلات رابطهاش صحبت کرده و در بخشی از مکالمه، افکار و خیالپردازیهای خشونتآمیز مطرح کرده است.
🚨 این گفتگو توسط سیستمهای ایمنی پرچمگذاری و در ادامه به FBI ارجاع شده است.
مقامات نیز با استناد به این مکالمات برای دریافت مجوز بازرسی اقدام کردند. این فرد در نهایت به اتهاماتی از جمله تهدید کتبی به قتل و تعقیب تشدیدشده محکوم شد و ۸ سال تحت نظارت قضایی قرار گرفت.
📌 این ماجرا یک سؤال جدی ایجاد میکند:
آیا گفتوگو با یک AI واقعاً خصوصی است، یا در شرایط خاص میتواند به اطلاعاتی تبدیل شود که در اختیار مراجع قانونی قرار بگیرد؟ ⚠️
البته جزئیات حقوقی و اینکه دقیقاً چه اطلاعاتی و تحت چه فرایندی به مقامات منتقل شده، برای قضاوت درباره این پرونده اهمیت زیادی دارد.
😳 AI
از انسانها در کلاهبرداری هم بهتر شده!
یک مطالعه جدید نشان داده چتباتهای هوش مصنوعی در برخی کلاهبرداریهای عاشقانه (Romance Scam) میتوانند قربانیان را بسیار مؤثرتر از کلاهبرداران انسانی متقاعد کنند.
📊 نتیجه جالب: 🤖 AI: ۴۶٪ افراد را متقاعد کرد یک اپلیکیشن را دانلود کنند.
👤 کلاهبرداران انسانی: ۱۸٪
یعنی در این آزمایش، نرخ موفقیت AI بیش از ۲.۵ برابر انسانها بوده است.
⚠️ دلیلش هم مشخص است: AI میتواند همزمان با افراد زیادی صحبت کند، پاسخهای کاملاً شخصیسازیشده بدهد و ساعتها بدون خستگی ادامه دهد.
📌 نگرانی اصلی اینجاست که AI ممکن است نهتنها ابزار جدید کلاهبرداران باشد، بلکه کلاهبرداری را آنقدر ارزان و مقیاسپذیر کند که حتی جای کلاهبرداران انسانی را بگیرد. 🤯
از انسانها در کلاهبرداری هم بهتر شده!
یک مطالعه جدید نشان داده چتباتهای هوش مصنوعی در برخی کلاهبرداریهای عاشقانه (Romance Scam) میتوانند قربانیان را بسیار مؤثرتر از کلاهبرداران انسانی متقاعد کنند.
📊 نتیجه جالب: 🤖 AI: ۴۶٪ افراد را متقاعد کرد یک اپلیکیشن را دانلود کنند.
👤 کلاهبرداران انسانی: ۱۸٪
یعنی در این آزمایش، نرخ موفقیت AI بیش از ۲.۵ برابر انسانها بوده است.
⚠️ دلیلش هم مشخص است: AI میتواند همزمان با افراد زیادی صحبت کند، پاسخهای کاملاً شخصیسازیشده بدهد و ساعتها بدون خستگی ادامه دهد.
📌 نگرانی اصلی اینجاست که AI ممکن است نهتنها ابزار جدید کلاهبرداران باشد، بلکه کلاهبرداری را آنقدر ارزان و مقیاسپذیر کند که حتی جای کلاهبرداران انسانی را بگیرد. 🤯
Media is too big
VIEW IN TELEGRAM
💉🤖 رباتی که خودش از بیمار خون میگیرد!
ربات Aletta در هلند توانسته فرایند خونگیری را کاملاً خودکار انجام دهد.
🧠 با کمک هوش مصنوعی و سونوگرافی:
رگ را پیدا میکند
سوزن را وارد میکند
خونگیری را انجام میدهد
سوزن را خارج میکند
حتی محل را پانسمان میکند
😳 بدون دخالت دست انسان!
طبق گزارش، تا ۹۸٪ بیماران گفتهاند که حاضرند دوباره این روش را تجربه کنند.
🏥 این فناوری در حال حاضر در چند بیمارستان هلند مورد استفاده قرار گرفته است.
📌 شاید در آینده خونگیری هم مثل بسیاری از کارهای پزشکی، از یک مهارت انسانی به یک فرایند کاملاً خودکار و دقیق تبدیل شود. 🤖🩸
ربات Aletta در هلند توانسته فرایند خونگیری را کاملاً خودکار انجام دهد.
🧠 با کمک هوش مصنوعی و سونوگرافی:
رگ را پیدا میکند
سوزن را وارد میکند
خونگیری را انجام میدهد
سوزن را خارج میکند
حتی محل را پانسمان میکند
😳 بدون دخالت دست انسان!
طبق گزارش، تا ۹۸٪ بیماران گفتهاند که حاضرند دوباره این روش را تجربه کنند.
🏥 این فناوری در حال حاضر در چند بیمارستان هلند مورد استفاده قرار گرفته است.
📌 شاید در آینده خونگیری هم مثل بسیاری از کارهای پزشکی، از یک مهارت انسانی به یک فرایند کاملاً خودکار و دقیق تبدیل شود. 🤖🩸
Media is too big
VIEW IN TELEGRAM
🧠 ChatGPT حالا فعالیتهای شما روی مک را به خاطر میسپارد!
نسخه دسکتاپ ChatGPT برای Mac قابلیت جدیدی به نام Computer History دریافت کرده که میتواند فعالیتهای اخیر شما در اپلیکیشنها و سایتها را برای استفاده در گفتگوهای بعدی به خاطر بسپارد. 🤖
🔹 میتواند کارهای اخیر، فایلها و روند انجام پروژهها را به یاد بیاورد.
🔹 بدون نیاز به توضیح دوباره، میتواند ادامه کار را در چت دنبال کند.
🔹 فعالیتهایی مثل کلیک، تایپ و جابهجایی بین برنامهها ثبت میشوند.
🔒 اما طبق اعلام OpenAI، تصویر صفحه، میکروفون و صدای سیستم ضبط نمیشود و دادهها تا ۴۸ ساعت روی مک باقی میمانند.
⚙️ این قابلیت بهصورت پیشفرض خاموش است و کاربران میتوانند آن را متوقف یا تاریخچه را حذف کنند.
📌 فعلاً برای کاربران Pro، Business و Enterprise در حال انتشار است.
😶 یعنی ChatGPT کمکم از «چتبات» به چیزی شبیه دستیار شخصی که میداند روی کامپیوترتان چه کار میکنید تبدیل میشود.
نسخه دسکتاپ ChatGPT برای Mac قابلیت جدیدی به نام Computer History دریافت کرده که میتواند فعالیتهای اخیر شما در اپلیکیشنها و سایتها را برای استفاده در گفتگوهای بعدی به خاطر بسپارد. 🤖
🔹 میتواند کارهای اخیر، فایلها و روند انجام پروژهها را به یاد بیاورد.
🔹 بدون نیاز به توضیح دوباره، میتواند ادامه کار را در چت دنبال کند.
🔹 فعالیتهایی مثل کلیک، تایپ و جابهجایی بین برنامهها ثبت میشوند.
🔒 اما طبق اعلام OpenAI، تصویر صفحه، میکروفون و صدای سیستم ضبط نمیشود و دادهها تا ۴۸ ساعت روی مک باقی میمانند.
⚙️ این قابلیت بهصورت پیشفرض خاموش است و کاربران میتوانند آن را متوقف یا تاریخچه را حذف کنند.
📌 فعلاً برای کاربران Pro، Business و Enterprise در حال انتشار است.
😶 یعنی ChatGPT کمکم از «چتبات» به چیزی شبیه دستیار شخصی که میداند روی کامپیوترتان چه کار میکنید تبدیل میشود.
🤯 یک مدل ویدیویی متنباز با فقط ۶B پارامتر فعال!
شرکت Sand.ai مدل ویدیویی جدید MAGI-2 Preview را بهصورت متنباز منتشر کرده است. 🎬🤖
🔹 معماری MoE با مجموع ۱۱۴ میلیارد پارامتر
🔹 در هر مرحله فقط ۶ میلیارد پارامتر فعال میشود
🔹 تولید ویدیوهای ۱۰ ثانیهای همراه با صدای همگام
🔹 خروجی نهایی تا 1080p با یک مرحله ارتقای کیفیت
🔹 قرار گرفتن در رتبه ۶ Artificial Analysis
💰 مهمترین نکته: بهدلیل فعال بودن تنها ۶B پارامتر، هزینه پردازش مدل حدود ۱۰ برابر کمتر از مدلهای متراکم مشابه گزارش شده است.
⚠️ البته برای اجرای محلی هنوز به سختافزار قدرتمندی نیاز دارد و برخلاف بعضی مدلهای رقیب، روی یک کارت ۲۴GB بهراحتی اجرا نمیشود.
📌 ترکیب MoE + ویدیو + صوت همزمان + متنباز بودن، MAGI-2 را به یکی از پروژههای جالب نسل جدید مدلهای ویدیویی تبدیل کرده است. 🔥
شرکت Sand.ai مدل ویدیویی جدید MAGI-2 Preview را بهصورت متنباز منتشر کرده است. 🎬🤖
🔹 معماری MoE با مجموع ۱۱۴ میلیارد پارامتر
🔹 در هر مرحله فقط ۶ میلیارد پارامتر فعال میشود
🔹 تولید ویدیوهای ۱۰ ثانیهای همراه با صدای همگام
🔹 خروجی نهایی تا 1080p با یک مرحله ارتقای کیفیت
🔹 قرار گرفتن در رتبه ۶ Artificial Analysis
💰 مهمترین نکته: بهدلیل فعال بودن تنها ۶B پارامتر، هزینه پردازش مدل حدود ۱۰ برابر کمتر از مدلهای متراکم مشابه گزارش شده است.
⚠️ البته برای اجرای محلی هنوز به سختافزار قدرتمندی نیاز دارد و برخلاف بعضی مدلهای رقیب، روی یک کارت ۲۴GB بهراحتی اجرا نمیشود.
📌 ترکیب MoE + ویدیو + صوت همزمان + متنباز بودن، MAGI-2 را به یکی از پروژههای جالب نسل جدید مدلهای ویدیویی تبدیل کرده است. 🔥
💎 تلگرام برای گرفتن پسوند دامنه .gram درخواست داده. اگر این درخواست توسط ICANN تأیید بشه، یک میلیارد کاربر تلگرام میتونن دامنه سطح دوم مخصوص خودشون رو داشته باشن. 🖥 مثلاً @durov میتونه durov.gram داشته باشه و @monk هم monk.gram. کاربران میتونن فقط با نوشتن یک پرامپت، وبسایتهای تعاملی خودشون رو روی زیرساخت تلگرام راهاندازی کنن ✨
🔎 فقط
خیلیها برای پیدا کردن محتوای عمومی تلگرام فقط اینو میزنن:
اما میتونید دامنههای دیگه مرتبط با تلگرام رو هم جستجو کنید 👇
🔍
🔍
🔍
🔍
🔍
مثلاً دنبال کانالهای VPN هستید:
یا میخواید صفحات مرتبط با Amnezia رو پیدا کنید:
📌 حتی میتونید چند منبع رو با
این ترفند برای OSINT، پیدا کردن کانالها، پستهای قدیمی و منابع مرتبط با یک موضوع خیلی کاربردیه.
#OSINT #Telegram
site:t.me نیست! | جستجوی حرفهای تلگرامخیلیها برای پیدا کردن محتوای عمومی تلگرام فقط اینو میزنن:
site:t.me VPNاما میتونید دامنههای دیگه مرتبط با تلگرام رو هم جستجو کنید 👇
🔍
site:t.me VPN🔍
site:tgchannels.org VPN🔍
site:telemetr.me "Amnezia"🔍
site:telegra.ph "VLESS"🔍
site:tgramsearch.com VPNمثلاً دنبال کانالهای VPN هستید:
site:t.me VPNیا میخواید صفحات مرتبط با Amnezia رو پیدا کنید:
site:telemetr.me "Amnezia"📌 حتی میتونید چند منبع رو با
OR ترکیب کنید:site:t.me VPN OR site:tgchannels.org VPNاین ترفند برای OSINT، پیدا کردن کانالها، پستهای قدیمی و منابع مرتبط با یک موضوع خیلی کاربردیه.
#OSINT #Telegram
🎬 مدل ویدیویی متنباز MAGI-2 با ۱۱۴ میلیارد پارامتر!
شرکت Sand.ai مدل MAGI-2 Preview را همراه با کد و وزنهای آن متنباز کرده است. 🤖
🔥 ویژگیهای مهم:
🧠 معماری MoE با ۱۱۴B پارامتر، اما فقط ۶B پارامتر فعال در هر توکن
🎥 تولید ویدیوی ۱۰ ثانیهای همراه با صدای هماهنگ
📺 ارتقای خروجی تا 1080p
💰 هزینه پردازش حدود ۱۰ برابر کمتر از مدلهای Dense مشابه
🏆 رتبه ۶ در Artificial Analysis
مدل ابتدا ویدیو را با وضوح پایین تولید میکند و سپس یک Refiner آن را تا 1080p ارتقا میدهد.
⚠️ برای اجرای محلی هنوز سختافزار قدرتمندی لازم دارد؛ اما بهدلیل فعال بودن تنها ۶B پارامتر، برای سرویسهای ابری و API پتانسیل بسیار بالایی دارد.
📌 یک مدل متنباز که میتواند همزمان تصویر، حرکت و صدا تولید کند؛ رقابت مدلهای ویدیویی جدیتر از همیشه شده است. 🔥
شرکت Sand.ai مدل MAGI-2 Preview را همراه با کد و وزنهای آن متنباز کرده است. 🤖
🔥 ویژگیهای مهم:
🧠 معماری MoE با ۱۱۴B پارامتر، اما فقط ۶B پارامتر فعال در هر توکن
🎥 تولید ویدیوی ۱۰ ثانیهای همراه با صدای هماهنگ
📺 ارتقای خروجی تا 1080p
💰 هزینه پردازش حدود ۱۰ برابر کمتر از مدلهای Dense مشابه
🏆 رتبه ۶ در Artificial Analysis
مدل ابتدا ویدیو را با وضوح پایین تولید میکند و سپس یک Refiner آن را تا 1080p ارتقا میدهد.
⚠️ برای اجرای محلی هنوز سختافزار قدرتمندی لازم دارد؛ اما بهدلیل فعال بودن تنها ۶B پارامتر، برای سرویسهای ابری و API پتانسیل بسیار بالایی دارد.
📌 یک مدل متنباز که میتواند همزمان تصویر، حرکت و صدا تولید کند؛ رقابت مدلهای ویدیویی جدیتر از همیشه شده است. 🔥
This media is not supported in your browser
VIEW IN TELEGRAM
🎨 Claude Code
حالا میتواند برایتان UI طراحی کند!
Anthropic
قابلیت جدید /design را بهصورت Research Preview به Claude Code اضافه کرده است. 🤖💻
با این قابلیت میتوانید فقط ظاهر و ایده رابط کاربری را توضیح دهید؛ Claude چند طرح قابل ویرایش ایجاد میکند.
سپس میتوانید: 1️⃣ طرح موردنظر را انتخاب کنید
2️⃣ آن را دستی اصلاح کنید
3️⃣ از Claude بخواهید همان طراحی را به رابط کاربری واقعی و قابل اجرا تبدیل کند.
📌 یعنی مسیر ایده → طراحی → کدنویسی حالا میتواند تقریباً در یک محیط انجام شود. 🔥
حالا میتواند برایتان UI طراحی کند!
Anthropic
قابلیت جدید /design را بهصورت Research Preview به Claude Code اضافه کرده است. 🤖💻
با این قابلیت میتوانید فقط ظاهر و ایده رابط کاربری را توضیح دهید؛ Claude چند طرح قابل ویرایش ایجاد میکند.
سپس میتوانید: 1️⃣ طرح موردنظر را انتخاب کنید
2️⃣ آن را دستی اصلاح کنید
3️⃣ از Claude بخواهید همان طراحی را به رابط کاربری واقعی و قابل اجرا تبدیل کند.
📌 یعنی مسیر ایده → طراحی → کدنویسی حالا میتواند تقریباً در یک محیط انجام شود. 🔥
🚨 OpenAI
نوجوانان را در ChatGPT جدا میکند!
طبق این گزارش، کاربران ۱۳ تا ۱۷ ساله نسخهای متفاوت از ChatGPT دریافت میکنند که محدودیتهای سختگیرانهتری برای محتوای آسیبزا دارد. 🤖
🔹 این نسخه نمیتواند احساسات را شبیهسازی کند یا تکالیف مدرسه را بهصورت آماده تحویل دهد.
🔹 سن کاربر با بررسی بیش از ۲۰۰۰ سیگنال رفتاری، از جمله زمان ورود به حساب، تخمین زده میشود.
🔹 برای تشخیص سن، الزاماً نیازی به ارائه مدرک هویتی نیست.
⚠️ این تغییرات پس از افزایش نگرانیها و پروندههای حقوقی مرتبط با دسترسی کودکان به محتوای آسیبزا مطرح شده است.
📌 به نظر میرسد شرکتهای AI حالا به سمت تجربههای متفاوت و متناسب با سن کاربر حرکت میکنند. 👦🤖
نوجوانان را در ChatGPT جدا میکند!
طبق این گزارش، کاربران ۱۳ تا ۱۷ ساله نسخهای متفاوت از ChatGPT دریافت میکنند که محدودیتهای سختگیرانهتری برای محتوای آسیبزا دارد. 🤖
🔹 این نسخه نمیتواند احساسات را شبیهسازی کند یا تکالیف مدرسه را بهصورت آماده تحویل دهد.
🔹 سن کاربر با بررسی بیش از ۲۰۰۰ سیگنال رفتاری، از جمله زمان ورود به حساب، تخمین زده میشود.
🔹 برای تشخیص سن، الزاماً نیازی به ارائه مدرک هویتی نیست.
⚠️ این تغییرات پس از افزایش نگرانیها و پروندههای حقوقی مرتبط با دسترسی کودکان به محتوای آسیبزا مطرح شده است.
📌 به نظر میرسد شرکتهای AI حالا به سمت تجربههای متفاوت و متناسب با سن کاربر حرکت میکنند. 👦🤖
🤯 هزینه Agentهای GPT-5.6 بهشدت کاهش پیدا کرد!
OpenAI نشان داده GPT-5.6 Luna میتواند با هزینه بسیار کمتر، عملکردی نزدیک به مدلهای قدرتمندتر ارائه دهد. 🤖
📊 در تست BrowseComp:
GPT-5.6 Luna: 84.04٪
GPT-5.5: 84.36٪
💰 اما هزینه اجرای تست: Luna: فقط ۱.۳۳ دلار
GPT-5.5: حدود ۳۳.۲۷ دلار
یعنی تقریباً ۲۵ برابر ارزانتر! 😳
برای کارهای Agentی مثل استخراج داده و جستوجوی اسناد، OpenAI استفاده از Luna و Terra را پیشنهاد میکند.
🔥 نکته جالبتر این است که در ARC-AGI-3، بهینهسازی معماری Agent باعث شد امتیاز Sol از ۱۳.۳٪ به ۳۸.۳٪ برسد، در حالی که خود مدل تغییری نکرده بود و حدود ۶ برابر توکن خروجی کمتری مصرف کرد.
📌 یعنی آینده Agentها فقط به باهوشتر شدن مدل وابسته نیست؛ نحوه مدیریت حافظه، استدلال و اجرای چندمرحلهای هم میتواند عملکرد را چند برابر کند.
OpenAI نشان داده GPT-5.6 Luna میتواند با هزینه بسیار کمتر، عملکردی نزدیک به مدلهای قدرتمندتر ارائه دهد. 🤖
📊 در تست BrowseComp:
GPT-5.6 Luna: 84.04٪
GPT-5.5: 84.36٪
💰 اما هزینه اجرای تست: Luna: فقط ۱.۳۳ دلار
GPT-5.5: حدود ۳۳.۲۷ دلار
یعنی تقریباً ۲۵ برابر ارزانتر! 😳
برای کارهای Agentی مثل استخراج داده و جستوجوی اسناد، OpenAI استفاده از Luna و Terra را پیشنهاد میکند.
🔥 نکته جالبتر این است که در ARC-AGI-3، بهینهسازی معماری Agent باعث شد امتیاز Sol از ۱۳.۳٪ به ۳۸.۳٪ برسد، در حالی که خود مدل تغییری نکرده بود و حدود ۶ برابر توکن خروجی کمتری مصرف کرد.
📌 یعنی آینده Agentها فقط به باهوشتر شدن مدل وابسته نیست؛ نحوه مدیریت حافظه، استدلال و اجرای چندمرحلهای هم میتواند عملکرد را چند برابر کند.