DevTwitter | توییت برنامه نویسی
30.3K subscribers
4.99K photos
395 videos
6 files
4.78K links
توییت های برنامه نویسی و طراحی وب :)

@dvtwi

Hashtags:
devtwitter.t.me/5

DevBooks Channel:
https://xn--r1a.website/+AYbOl75CLNYxY2U0

Github:
https://github.com/DevTwitter

X:
https://x.com/devtwittir
Download Telegram
این روزها برای هر مسئله‌ای سریع می‌ریم سراغ VLMها؛ حتی برای OCR و سؤال‌-جواب روی اسناد دست‌نویس. ولی خیلی وقت‌ها این بهترین انتخاب نیست.

اگر هدفتون اینه که روی هزاران/میلیون‌ها سند دست‌نویس جستجو و Question Answering انجام بدید، اینکه هر بار تصویر رو بدید به یک Vision-Language Model تا دوباره متن رو از روی پیکسل‌ها بخونه، هم گرونه، هم کند، و هم همیشه قابل اعتماد نیست. مدل هر بار باید با یک تصویر شاید تار یا ناخوانا کلنجار بره و نتیجه هم ممکنه هر دفعه کمی متفاوت باشه.

به‌جاش اول سعی کنید خود مرحله‌ی OCR رو تا جای ممکن بهینه کنید.

مثلاً:
* کیفیت تصویر رو بهتر کنید.
* از مدل‌های OCR تخصصی یا fine-tuned استفاده کنید.
* خروجی OCR رو با post-processing اصلاح کنید.
* اگر لازمه چند OCR مختلف رو ترکیب کنید یا از domain knowledge (اطلاعات دامنه) استفاده کنید.

وقتی متن باکیفیت استخراج شد، بقیه‌ی مسیر خیلی ساده‌تر و ارزان‌تر می‌شه: متن رو embed و index کنید، جستجو روی متن انجام بدید، و فقط در صورت نیاز تصویر اصلی رو برای راستی‌آزمایی یا نمایش برگردونید.

همیشه لازم نیست VLM روی مسیر اصلی (hot path) باشه. خیلی وقت‌ها یک OCR خوب + Retrieval متنی هم سریع‌تره، هم ارزان‌تر، و هم در مقیاس پایدارتر.

قبل از اینکه برای OCR سراغ VLM برید، از خودتون بپرسید: «آیا واقعا OCRم رو تا آخر بهینه کرده‌ام؟»
این بلاگ خیلی خوب توضیح میده که چطور OCR را با DSPy بهینه کنید. به همراه کد:
https://lancedb.com/blog/make-handwritten-notes-searchable-optimizing-an-ocr-pipeline-with-lancedb

@DevTwitter | <Mehdi Allahyari/>
24👍7👎3
اگه با Claude Code یا Cursor کار می‌کنی و از UIهایی که AI برات می‌سازه خسته شدی (همون طراحی‌های تکراری و بی‌روح)، این Skill دقیقاً همون چیزیه که لازم داری،ذخیره کن کاربردیست

این ریپو یه دانش‌نامه طراحی حرفه‌ای به AI می‌ده شامل:
- ۶۷ استایل UI مختلف
- ۱۶۱ پالت رنگ دقیق
- ۵۷ جفت فونت آماده
- ۹۹ قانون UX و بهترین شیوه‌ها
- پشتیبانی از React, Next.js, Tailwind, shadcn/ui, Flutter, SwiftUI و …

حتی یه Design System Generator داره که با یه پرامپت ساده، کل سیستم طراحی پروژه‌ت رو (رنگ، تایپو، کامپوننت، الگوها) برات می‌سازه.
دیگه لازم نیست کلی پرامپت طولانی بنویسی یا خودت دستی فیکس کنی. AI حالا تقریبا “می‌فهمه” چی مناسب و حرفه‌ایه.

https://github.com/nextlevelbuilder/ui-ux-pro-max-skill

@DevTwitter | <Navid Taheri/>
👍39👎5🍌4
Forwarded from DevTwitter Ads.
توییتر دانشجویی دانشگاه شریف را دنبال کنید👇

https://xn--r1a.website/+nJBzRIK7ADM4YzE0
🍌23👎84
یه مدت طولانیی از termius استفاده میکردم و اشتراکی بودن خیلی از فیچراش اذیتم کرد، تا اینکه این ssh client نوشته شده با Rust رو پیدا کردم:
https://github.com/wilsonglasser/oryxis

خیلی سریع و سبکه، فیچراش از termius پولی هم بیشتره!
برنامه نویسش هم ادم پیگیریه issue باز کنی فرداش جواب میده


@DevTwitter | <Zeth/>
👍3410🔥3
این ابزار کل کدبیس را به یک گراف دانش تبدیل می‌کند تا Agentها به‌جای باز کردن مداوم فایل‌ها و دنبال کردن importها، ساختار پروژه و ارتباطات بین بخش‌های مختلف آن را مستقیما درک کنند
https://github.com/Graphify-Labs/graphify

@DevTwitter | <Davinchi/>
👍20
تو این ریپازیتوری یه مجموعه از اسکیل‌های کاربردی روزمره‌ی Claude رو جمع کردم.
از دیباگ و کد ریویو و دیتابیس گرفته تا AI، تست، داکیومنت و دیزاین.
به خودم خیلی کمک میکنه، اگه دوس داشتین استفاده کنید:
https://github.com/nimadorostkar/Claude-Skills-collection

@DevTwitter | <Nima/>
🍌1310👍3
🗂دوره مقدماتی مدیریت ارتباط با مشتری (CRM)
💎از شناخت مشتری تا وفادارسازی

📸مدرس:حمید محمودزاده
#⃣مدیرعامل CRM دیدار؛ یکی از شناخته‌شده‌ترین نرم‌افزارهای مدیریت ارتباط با مشتری

🗓 سه شنبه، ۳۰ تیرماه| ۱۵:۰۰ تا ۱۷:۰۰
💻 آنلاین

📌با 40% تخفیف برای دانشجویان

🎓 همراه با گواهی معتبر از دانشگاه علامه طباطبایی

✉️ جهت ثبت‌نام و کسب اطلاعات بیشتر:
📱 @ertebatinou
👩‍💻 @ertebatinou_admin3
Please open Telegram to view this post
VIEW IN TELEGRAM
🍌9👎52
This media is not supported in your browser
VIEW IN TELEGRAM
یه طراح فونتی به نام Ghost Font ساخته که نوشته‌ها رو بین هزاران نقطه متحرک پنهان می‌کنه.

چشم و مغز ما می‌تونه کلمات رو تشخیص بده، اما هوش مصنوعی معمولاً فقط یه مشت نقطه و نویز می‌بینه و نمی‌تونه متن رو درست بخونه.

خودتون تستش کنید:

https://ghostfont.org

@DevTwitter | <Roozbeh/>
🔥73👎75
مخزنHallmarlk یک skill برای Claude Code و Cursor و Codex.

کارش اینه: AI-slop design رو بکشه بیرون از خروجی.
همون حس پلاستیکی UI که AI می‌ده رو می‌گیره، تمیزتر و انسانی‌تر می‌کنه.

برای designer و AI creator ها خیلی به درد می‌خوره. مستقیم تو workflow می‌شینه.

https://github.com/Nutlope/hallmark

@DevTwitter | <Diego Jr/>
👍17🍌2👎1
مجموعه‌ای از 46 Skill کاربردی برای بازاریابی سئو تولید محتوا و رشد محصول که برای استفاده با Claude Code و Codex طراحی شده است.

https://github.com/coreyhaines31/marketingskills

@DevTwitter | <Davinchi/>
👍7🍌73
This media is not supported in your browser
VIEW IN TELEGRAM
روزی نیست که فعالیت AI Agentها را در لاگ نبینیم.
یکسری AI agent با دسترسی اولیه محدود، به‌صورت خودکار و هوشمند محیط را enumerate می‌کند و سریع credential harvesting انجام میدهند و اگر موفق شوند، lateral movement و privilege escalation و نهایتا code execution انجام می‌دهند. سپس persistence ایجاد کرده و داده‌ها را exfiltrate می‌کند. همه این ها با کمک AI در کمتر از چند دقیقه رخ میدهد!

اینجاست که به عنوان Defender ما هم به صورت هوشمند جلو این حملات را بگیریم که به خاطر همین Context Bomb ساخته شده.
وقتی AI agent در حال کاوش محیط، به secret تله می‌رسد و محتوای بمب را می‌خواند، guardrailهای ایمنی مدل (مثل ممنوعیت موضوعات حساس) فعال می‌شود. مدل امتنا می‌کند و حمله به طور کامل متوقف می‌شود.
در عین حال، defender هم alert دریافت می‌کند که حمله در جریان بوده.
به زبان ساده: تله نه تنها حمله را تشخیص می‌دهد، بلکه باعث می‌شود خود AI خودش را متوقف کند.
https://agentic.tracebit.com/context-bombs/

@DevTwitter | <VAHID NAMENI/>
🍌18👍115
خب، بالاخره رفتیم پشت دیوار
مقاله کامل طراحی سیستم یک پلتفرم شبیه دیوار منتشر شد.
توش از ثبت آگهی و Search گفتیم تا چت، پردازش تصویر، پرداخت، Moderation، تقلب و مقیاس‌پذیری.

لینک مقاله در ویرگول:

https://vrgl.ir/eY76N

@DevTwitter | <Afshin Yarinia/>
👍46🍌7👎4
به عنوان نسل مار گزیده قطع اینترنت، بخشی از حیات دیجیتال ما به self-host کردن بعضی سرویس‌های کاربردی وابسته است.

برای اینکه چیزی شبیه گوگل درایو ولی به شکل storage-agnostic داشته باشید
https://github.com/cloudreve/cloudreve
رو ببینید. می‌دونم راهکارهای «همه کار کن» هست ولی اینو پیشنهاد می‌کنم.

@DevTwitter | <Hamed/>
👍17🍌4💔2
برای راحت‌تر شدن اکسپورت لیست دروس از آموزشیار، یه اکستنشن نوشتم که می‌تونه دروس رو از جدول آموزشیار جمع‌آوری کنه و خروجی Excel یا PDF بهتون بده.

برای Firefox، افزونه از طریق Firefox Add-ons قابل نصب
هست
لینک افزونه

اگه از Chrome یا سایر مرورگرهای مبتنی بر Chromium مثل Edge، Brave یا Opera استفاده می‌کنید، می‌تونید سورس پروژه رو از GitHub دریافت کنید و از طریق گزینه Load unpacked به مرورگر اضافه کنید.
https://github.com/EhsanKey/amozeshyar-exporter

@DevTwitter | <Ehsan Keyhani/>
👍25🔥10👎3
داشتم دنبال یه سرویس Text To Speech که زبان فارسی رو هم خوب پشتیبانی کنه میگشتم که openai.fm رو پیدا کردم.
یه کلاینت Text To Speech عالی که از API های GPT-4o mini TTS استفاده میکنه.
قابلیت انتخاب گوینده های متنوعی داره، میتونید Vibe متن رو بهش بدید و مطابق با اون، صدا رو تحویل بگیرید.
حتی یه قسمت داره که میتونید توی Prompt بهش بگید که سرعت، تن صدا، احساس و ... چطور باشه.

@DevTwitter | <Ali Amoori/>
👍17🍌83
اگر با فایل‌ های Word که شامل سئوالات تستی هستند کار کرده باشید، احتمالا با این مشکل مواجه شده‌اید که جواب صحیح هر سئوال با یک کلمه مثل (صحیح) مشخص شده، اما پیدا کردن همه جواب‌ ها بین گزینه‌ ها همیشه کار راحتی نیستش و بعضی موقع ها ممکنه یک مورد را از دست بدین.

این ماکرو بر اساس کلمه‌ ای که شما انتخاب می‌کنید کار میکنه، کافیه که یک عبارت مشخص مثل کلمه (صحیح) را انتخاب کنید، بعدش تمام بخش‌ هایی از سند که این کلمه تو اونها وجود داره پیدا میشن و کل پاراگراف مربوط به اون از اولین تا اخرین کاراکتر، بدون توجه به استایل یا نوع متن بصورت خودکار هایلایت میشن.

برای استفاده در فایل‌ های تستی، فقط کافیه که کلمه مشخص‌ کننده جواب درست تو تمام گزینه‌ های صحیح وجود داشته باشه.

البته کاربردش هم فقط به سئوالات تستی محدود نیست، برای پیدا کردن و مشخص کردن سریع کلمات یا عبارت‌ های تکرار شونده در فایل‌های Word هم میتونه استفاده بشه.

https://gist.github.com/Mahdi-Cheraghi/f5166b1c32ac6c6f1384524254442135

@DevTwitter | <Mahdi Cheragi/>
👍14🍌6👎3
چند وقت پیش متوجه شدم که Docker Image پروژه‌ام بعد از هر تغییر کوچکی در سورس کد، از اول Build می‌شه.

مشکل رو با AI بررسی کردم و فهمیدم مشکل از ترتیب چند خط در Dockerfile بوده است!
من این اشتباه رو در 90٪ پروژه‌هام انجام داده بودم؛ اشتباهی که هر روز چند دقیقه و گاها چند ساعت از زمانم رو هدر داده.
به دنبال بررسی بیشتر موضوع ترتیب دستورات در Dockerfile؛ رسیدم به مفهوم Docker build cache.

اگر ترتیب دستورات در Dockerfile شما شبیه این هستش:
COPY . .
RUN npm install

هر بار که حتی یک خط از app.js یا هر فایل دیگه‌ای رو تغییر بدین، Docker مجبور میشه دوباره مرحله‌ی npm install رو اجرا کنه.
در حالی که وابستگی‌های پروژه اصلاً تغییر نکردند!

دلیلش چیه؟
داکر Image رو به صورت لایه به لایه می‌سازه و هر دستور در Dockerfile یک Layer جدید ایجاد می‌کنه.
اگر یک Layer تغییر کنه، خود اون Layer به همراه تمام Layerهای بعدیش دوباره ساخته میشن.

به همین دلیل، این ترتیب در Dockerfile بسیار بهینه‌تر هستش:
COPY package*.json ./
RUN npm install
COPY . .

چون فایل‌های`package.json` و package-lock.json معمولاً کمتر از سورس پروژه تغییر می‌کنند.
بنابراین Docker می‌تونه Layer مربوط به نصب پکیج‌ها رو Cache کنه و در Buildهای بعدی، اگر فقط کد برنامه تغییر کرده باشد، فقط سورس کد رو کپی کنه و دیگه npm install رو ران نکنه.

نتیجه؟
مصرف کمتر CPU و Disk و Build سریع‌تر

این اصل فقط مخصوص Node.js نیست و در همه اکوسیستم‌ها وجود داره؛ مثلا در پایتون اول باید فایل requirements.txt کپی بشه و pip install انجام بشه و بعدا سورس کد پروژه کپی بشه.

فایل‌هایی که کمتر تغییر می‌کنند رو زودتر کپی کنید و دستور کپی فایل‌هایی که بیشتر تغییر می‌کنند رو در انتهای Dockerfile قرار بدین.

گاهی بهینه‌سازی یعنی اضافه کردن تکنولوژی جدید.
اما گاهی فقط یعنی ترتیب دو خط کد را عوض کنید

داکیومنت داکر در رابطه با این موضوع:
https://docs.docker.com/build/cache/

@DevTwitter | <Razie RezaAli/>
55🍌25👍11
قبل از اینکه هکرها آسیب‌پذیری سایتت رو پیدا کنن، خودت پیداش کن!

اخیراً به ابزار Deep Eye برخوردم که برای ارزیابی امنیت اپلیکیشن‌های وب ساخته شده.

طبق توضیحات پروژه، می‌تونه بیش از 45 آسیب‌پذیری رایج مثل SQL Injection، XSS، SSRF، XXE، SSTI، RCE، مشکلات JWT، OAuth و... رو بررسی کنه.

البته این ابزار جای Security Review یا تست دستی رو نمی‌گیره، اما برای ارزیابی اولیه و پیدا کردن ضعف‌های رایج، می‌تونه زمان زیادی رو ذخیره کنه.

اگه روی پروژه‌های وب کار می‌کنید، داشتن چنین ابزارهایی کم‌کم داره از «آپشن» به «ضرورت» تبدیل می‌شه.

https://github.com/zakirkun/deep-eye

@DevTwitter | <Sadra Majidi/>
27👍8🔥4
This media is not supported in your browser
VIEW IN TELEGRAM
شرکت OpenAI رسماً از Codex Micro رونمایی کرد؛ کیبورد ۲۳۰ دلاری برای وایب‌کدینگ

شرکت OpenAI سرانجام اولین گام رسمی را برای ورود به دنیای سخت‌افزار برداشت. این شرکت به تازگی از کیبورد کوچکی به نام Codex Micro رونمایی کرد که با قیمت ۲۳۰ دلار به فروش می‌رسد. این گجت که به‌طور خاص برای کنترل دستیار برنامه‌نویسی این شرکت و وایب‌کدینگ طراحی شده است، به کاربران امکان می‌دهد تا بات‌های هوش مصنوعی خود را بهتر مدیریت کنند.

اوپن‌ای‌آی این دستگاه را به عنوان راهکاری جدید و لوکس برای مدیریت ایجنت‌های هوش مصنوعی معرفی می‌کند. کیبورد کدکس میکرو شش کلید مات مجهز به نورپردازی ال‌ای‌دی دارد که وضعیت فعالیت ایجنت‌ها را به صورت زنده نشان می‌دهند.

علاوه‌براین، کلیدهای دستوری با قابلیت شخصی‌سازی در این دستگاه تعبیه شده‌اند که میان‌برهایی برای کارهای رایج مانند تأیید یا ردکردن کدها و استفاده از ورودی صوتی هستند. وجود یک جوی‌استیک برای اجرای سریع گردش‌های کاری و یک دکمه چرخان برای تنظیم سطح استدلال هوش مصنوعی، از دیگر ویژگی‌های جالب این کیبورد است.

@DevTwitter | <Digiato/>
👎49🍌26🔥5