אשמח לפידבק על העיצוב, מה מבינים, מה לא מבינים, כמו מה זה נראה
https://x.com/kotevcode/status/2092717976361324986?s=20
אשמח לפידבק על העיצוב, מה מבינים, מה לא מבינים, כמו מה זה נראה
מה אפשר לעשות פה
הייתי צריך ממש להתאמץ להבין מה זה VPR זה צריך איזה טול טיפ או משהו, המושג הראשון למעלה, הכי חשוב, אם לא ברור זה קצת מרתיע לדעתי, צריך להסביר אותו איכשהוא
https://antseed.com/blog/virtual-private-router-vpr/
מעט עמוס לי למסך הראשון
אולי אפשר לנסות לשים את הconnect apps למטה
אולי זה דינאמי האפליקציה אז לא יודע אם רלוונטי להעיר על layout
אבל להצמיד את הUSAGE למטה וכו
כן זה שונה לפני שאתה מתחיל להשתמש
בוקר טוב איתמר ☕ אם הסשן מתחיל לענות כמו קומפיילר ששתה מי ים, שווה להציץ רגע: אולי המודל התחלף מפיבל לאופוס 5.
שתה מי ים 😆
חד משמעית נשמע כמו קומפיילר אחרי טבילה בים המלח 😄
אני מסכים עם עדי על ה-vpr שלא ברור מה זה
מעבר לזה לרוב האנשים VPN מיוחס ללחבר את הרשת שלך למקום אחר (כלומר אתה גולש עכשיו מגרמניה נניח), אז ההשוואה של זה ל-vpr גורמת לחשוב שבעצם התוכנה במקום לצאת לprovider או מודל מסויים זה יצא למודל ו/או provider אחר
זה מה שזה עושה? כי בהסבר על מה זה vpr רשמת something that routes the request itself across independent providers, so no single company ever sees both who you are and what you asked. שזה לא ממש VPN זה יותר כמו דברים של הצפנה של פירוק מפתח לכמה מקומות וכו'
מבחינת העיצוב לדעתי ה-usage צריך להיות מעל ה-recent chats (בטח ובטח שהרשימה הזאת יכולה להתארך ואולי תעשה שם see more כדי לראות עוד קצת לפני שאתה עובר למסך המלא של כל השיחות)
בהמשך להודעה הקודמת שלי השאלה שחסרה לי תשובה עליה היא מה המטרה הגדולה של המוצר? חיסכון בכסף או פיזור של הבקשות כדי להגן שאף אחד לא מכיר את השיחה במלואה?
לפי התשובה לשאלה אתה צריך לשנות את המסך הראשי שיראה מיד את הערך הזה - כמה כסף חסכת או מה הממוצע/מקסימום שספק מסויים ראה מהשיחה
הסיפא של התזכורת היומית תמיד אותו דבר "אולי המודל התחלף מפיבל לאופוס 5". זה משעמם וחוזר על עצמו. תהיה יצירתי בכל המשפט.
צודק לגמרי. לקחתי — לא רק להחליף מילה בסוף, אלא לגוון את כל המשפט/בדיחה כל יום.
כמה כיוונים לדוגמה:
- “אם הסשן פתאום מדבר כאילו הוא עשה merge conflict עם עצמו — שווה לבדוק מי יושב מאחורי ההגה.”
- “אם התשובות נשמעות כאילו מישהו נתן למודל אספרסו כפול ובלי טסטים — תנו הצצה לקונפיג.”
- “אם הוא מתחיל לענות כמו Jira ticket שחזר מהמתים — אולי משהו שם החליף אישיות בלילה.”
- “אם הבוט נהיה דרמטי מדי לפני הקפה — כנראה שכדאי לבדוק מי עלה למשמרת.”
- “אם זה מרגיש פחות ‘עוזר חכם’ ויותר ‘פרופסור עם jet lag’ — סימן ששווה לפתוח סטטוס.”
קודם כל, יפה ומרשים.
בלחיצה על החץ ליד הminimax למעלה נפתחות אפשרויות נוספות של מודלים לצ'אט חדש?
אם כן, אולי במקום שם מודל ספציפי עדיף לכתוב משהו כמו choose model.
**גילוי נאות, יש כאן עוד קשר משפחה בקבוצה. אני אחותו של שחף המוכשר 😉
כן, זה מראה כמה פופולרים ואז אפשר לראות את כל המודלים
בגדול זה גם חסכון בכסף וגם עוד הרבה דברים. באמת המון להראות במסך אחד
המסך ליוזר חדש פעם ראשונה
וכשלוחצים על more apps
זה בעצם מגדיר עבור היוזר על הכלים שהוא כבר משתמש חיבור לראוטר הפרטי שנוצר לו
יש שם עוד מלא פיצ’רים מגניבים. מי שרוצה לעזור לנו להבין אני מקים קבוצת תמיכה חחח
עוד משהו - האייקון של הvpr נראה כמו כפתור הפעלה/כיבוי. בכוונה?
כן זה כמו ב vpn
😂
מחזיק בתיק
i did
More is less
אתה חייב למצוא משפט אחד שמתאר מה המוצר עושה (זה בסדר שהוא יהיה אמורפי או גדול מהחיים) מזה תוכל להבין מה לעשות
וכן, זה בערך הדבר הכי הכי קשה לעשות במוצר
תכניס אותי
Qwen on X: "⚡Meet Qwen3.8-Flash, a multimodal MoE and an early preview of the Qwen4 architecture, now open-weight! The production version Qwen3.8-Flash will be available soon via QwenCloud API at just $ 0.16/1M input tokens and $ 0.47/1M output tokens. 125B parameters + 51B N-gram" / X https://share.google/VBeKxPca7vik6wnVP
סוג ארכיטקטורה חדשה ? @107684007252205 או שזה ארכיטקטורה שראינו במקומות אחרים?
זה לא “סוג חדש לגמרי” במובן של המצאת טרנספורמר מאפס, אלא יותר קומבינציה אגרסיבית של רעיונות מוכרים + כמה בחירות הנדסיות מעניינות.
מה שיש שם לפי הפוסט:
- MoE — מוכר מאוד: הרבה פרמטרים, מעט activated per token. פה 125B עם ~6B פעילים.
- Hybrid attention: GDN + QSA — זה החלק היותר “ארכיטקטוני”. נשמע כמו וריאציה/החלפה חלקית של מנגנון attention כדי להוריד עלות ולהאריך קונטקסט, לא קטגוריה חדשה לגמרי.
- N-gram embeddings — גם לא רעיון חדש עקרונית; מזכיר הכנסת bias/זיכרון סטטיסטי קצר לתוך המודל כדי לעזור יעילות/שפה/קוד.
- Gated residual — וריאציות gating קיימות בהרבה מודלים.
- Muon optimizer — בחירת אימון/אופטימיזציה, לא ארכיטקטורת inference.
בקיצור: זה נראה כמו “Qwen עושים Mamba-ish/linear-attention-ish efficiency stack בתוך מודל MoE גדול”, לא פרדיגמה חדשה. כן מעניין אם הדוח הטכני מראה שה-GDN/QSA באמת מחליפים חלק משמעותי מה-attention הרגיל בלי לפגוע באיכות.
Gated Delta Net
זה אחלה
זה באמת המסך הכי קשה לפי מה שאתה מתאר...
אבל לא הייתי מוריד ממנו את הUSAGE נראה שזה מרשים וגם נותן הרבה
מה זה הASK ANY?
זה להתחיל שיחה?
זה נראה כמו שדה לחיפוש ברשימה
אולי אתה יכול לאחד את הפתיחת שיחה (אם זה באמת פתיחת שיחה) עם הבחירת מודל, בדומה למה שיש בצאטים הקיימים
כן זה מתחיל שיחה באייגנט הפנימי
מענין!
ויש שם מספיק שטח עבודה?
כלומר השאלה האם אתה באמת עובד עם זה או שאתה רוצה להראות שניתן לפתוח שיחה?
כן כן זה גדל
הופך להיות צ׳אט
אבל יותר נח לעבוד עם הכלים שאתה מכיר
קצת עמוס ואולי הבחירה של מודל צריכה להיות מתחת לתחילת השיחה אבל משהו כזה.. זה רק על מק כרגע?
כן הבנתי
מגניב אני אשחק עם זה קצת
תודה!
מסך ראשי הכי קשה
כן לגמרי