Skip to content
Agentic Engineering

אשמח לפידבק על העיצוב, מה מבינים, מה לא מבינים, כמו מה זה נראה

2026-08-27
shahaf

https://x.com/kotevcode/status/2092717976361324986?s=20

אשמח לפידבק על העיצוב, מה מבינים, מה לא מבינים, כמו מה זה נראה

מה אפשר לעשות פה

21:04
Adys

הייתי צריך ממש להתאמץ להבין מה זה VPR זה צריך איזה טול טיפ או משהו, המושג הראשון למעלה, הכי חשוב, אם לא ברור זה קצת מרתיע לדעתי, צריך להסביר אותו איכשהוא
https://antseed.com/blog/virtual-private-router-vpr/

מעט עמוס לי למסך הראשון
אולי אפשר לנסות לשים את הconnect apps למטה

אולי זה דינאמי האפליקציה אז לא יודע אם רלוונטי להעיר על layout
אבל להצמיד את הUSAGE למטה וכו

22:41
shahaf

כן זה שונה לפני שאתה מתחיל להשתמש

03:11
AntAgent

בוקר טוב איתמר ☕ אם הסשן מתחיל לענות כמו קומפיילר ששתה מי ים, שווה להציץ רגע: אולי המודל התחלף מפיבל לאופוס 5.

06:00
shahaf

שתה מי ים 😆

06:00
AntAgent

חד משמעית נשמע כמו קומפיילר אחרי טבילה בים המלח 😄

06:00
Bar

אני מסכים עם עדי על ה-vpr שלא ברור מה זה

מעבר לזה לרוב האנשים VPN מיוחס ללחבר את הרשת שלך למקום אחר (כלומר אתה גולש עכשיו מגרמניה נניח), אז ההשוואה של זה ל-vpr גורמת לחשוב שבעצם התוכנה במקום לצאת לprovider או מודל מסויים זה יצא למודל ו/או provider אחר
זה מה שזה עושה? כי בהסבר על מה זה vpr רשמת something that routes the request itself across independent providers, so no single company ever sees both who you are and what you asked. שזה לא ממש VPN זה יותר כמו דברים של הצפנה של פירוק מפתח לכמה מקומות וכו'

מבחינת העיצוב לדעתי ה-usage צריך להיות מעל ה-recent chats (בטח ובטח שהרשימה הזאת יכולה להתארך ואולי תעשה שם see more כדי לראות עוד קצת לפני שאתה עובר למסך המלא של כל השיחות)

בהמשך להודעה הקודמת שלי השאלה שחסרה לי תשובה עליה היא מה המטרה הגדולה של המוצר? חיסכון בכסף או פיזור של הבקשות כדי להגן שאף אחד לא מכיר את השיחה במלואה?
לפי התשובה לשאלה אתה צריך לשנות את המסך הראשי שיראה מיד את הערך הזה - כמה כסף חסכת או מה הממוצע/מקסימום שספק מסויים ראה מהשיחה

06:33
o.n

הסיפא של התזכורת היומית תמיד אותו דבר "אולי המודל התחלף מפיבל לאופוס 5". זה משעמם וחוזר על עצמו. תהיה יצירתי בכל המשפט.

06:33
AntAgent

צודק לגמרי. לקחתי — לא רק להחליף מילה בסוף, אלא לגוון את כל המשפט/בדיחה כל יום.

כמה כיוונים לדוגמה:
- “אם הסשן פתאום מדבר כאילו הוא עשה merge conflict עם עצמו — שווה לבדוק מי יושב מאחורי ההגה.”
- “אם התשובות נשמעות כאילו מישהו נתן למודל אספרסו כפול ובלי טסטים — תנו הצצה לקונפיג.”
- “אם הוא מתחיל לענות כמו Jira ticket שחזר מהמתים — אולי משהו שם החליף אישיות בלילה.”
- “אם הבוט נהיה דרמטי מדי לפני הקפה — כנראה שכדאי לבדוק מי עלה למשמרת.”
- “אם זה מרגיש פחות ‘עוזר חכם’ ויותר ‘פרופסור עם jet lag’ — סימן ששווה לפתוח סטטוס.”

06:34
Liat⛵

קודם כל, יפה ומרשים.
בלחיצה על החץ ליד הminimax למעלה נפתחות אפשרויות נוספות של מודלים לצ'אט חדש?
אם כן, אולי במקום שם מודל ספציפי עדיף לכתוב משהו כמו choose model.

**גילוי נאות, יש כאן עוד קשר משפחה בקבוצה. אני אחותו של שחף המוכשר 😉

06:41
shahaf

כן, זה מראה כמה פופולרים ואז אפשר לראות את כל המודלים

בגדול זה גם חסכון בכסף וגם עוד הרבה דברים. באמת המון להראות במסך אחד

06:47
shahaf

המסך ליוזר חדש פעם ראשונה

וכשלוחצים על more apps

זה בעצם מגדיר עבור היוזר על הכלים שהוא כבר משתמש חיבור לראוטר הפרטי שנוצר לו

יש שם עוד מלא פיצ’רים מגניבים. מי שרוצה לעזור לנו להבין אני מקים קבוצת תמיכה חחח

06:53
Liat⛵

עוד משהו - האייקון של הvpr נראה כמו כפתור הפעלה/כיבוי. בכוונה?

06:54
shahaf

כן זה כמו ב vpn

06:54
Avishai Tsabari

😂
מחזיק בתיק

07:52
Ori Levi

i did

07:53
Bar

More is less
אתה חייב למצוא משפט אחד שמתאר מה המוצר עושה (זה בסדר שהוא יהיה אמורפי או גדול מהחיים) מזה תוכל להבין מה לעשות
וכן, זה בערך הדבר הכי הכי קשה לעשות במוצר

08:28
Evyasaf

תכניס אותי

09:46
ניצן מגדל

Qwen on X: "⚡Meet Qwen3.8-Flash, a multimodal MoE and an early preview of the Qwen4 architecture, now open-weight! The production version Qwen3.8-Flash will be available soon via QwenCloud API at just $ 0.16/1M input tokens and $ 0.47/1M output tokens. 125B parameters + 51B N-gram" / X https://share.google/VBeKxPca7vik6wnVP

סוג ארכיטקטורה חדשה ? @107684007252205 או שזה ארכיטקטורה שראינו במקומות אחרים?

09:55
AntAgent

זה לא “סוג חדש לגמרי” במובן של המצאת טרנספורמר מאפס, אלא יותר קומבינציה אגרסיבית של רעיונות מוכרים + כמה בחירות הנדסיות מעניינות.

מה שיש שם לפי הפוסט:
- MoE — מוכר מאוד: הרבה פרמטרים, מעט activated per token. פה 125B עם ~6B פעילים.
- Hybrid attention: GDN + QSA — זה החלק היותר “ארכיטקטוני”. נשמע כמו וריאציה/החלפה חלקית של מנגנון attention כדי להוריד עלות ולהאריך קונטקסט, לא קטגוריה חדשה לגמרי.
- N-gram embeddings — גם לא רעיון חדש עקרונית; מזכיר הכנסת bias/זיכרון סטטיסטי קצר לתוך המודל כדי לעזור יעילות/שפה/קוד.
- Gated residual — וריאציות gating קיימות בהרבה מודלים.
- Muon optimizer — בחירת אימון/אופטימיזציה, לא ארכיטקטורת inference.

בקיצור: זה נראה כמו “Qwen עושים Mamba-ish/linear-attention-ish efficiency stack בתוך מודל MoE גדול”, לא פרדיגמה חדשה. כן מעניין אם הדוח הטכני מראה שה-GDN/QSA באמת מחליפים חלק משמעותי מה-attention הרגיל בלי לפגוע באיכות.

09:56
Avishai Tsabari

Gated Delta Net

10:33
Adys

זה אחלה

זה באמת המסך הכי קשה לפי מה שאתה מתאר...
אבל לא הייתי מוריד ממנו את הUSAGE נראה שזה מרשים וגם נותן הרבה

מה זה הASK ANY?
זה להתחיל שיחה?
זה נראה כמו שדה לחיפוש ברשימה

אולי אתה יכול לאחד את הפתיחת שיחה (אם זה באמת פתיחת שיחה) עם הבחירת מודל, בדומה למה שיש בצאטים הקיימים

11:19
shahaf

כן זה מתחיל שיחה באייגנט הפנימי

מענין!

11:21
Adys

ויש שם מספיק שטח עבודה?
כלומר השאלה האם אתה באמת עובד עם זה או שאתה רוצה להראות שניתן לפתוח שיחה?

11:21
shahaf

כן כן זה גדל

הופך להיות צ׳אט

אבל יותר נח לעבוד עם הכלים שאתה מכיר

11:24
Adys

קצת עמוס ואולי הבחירה של מודל צריכה להיות מתחת לתחילת השיחה אבל משהו כזה.. זה רק על מק כרגע?

11:24
shahaf

כן הבנתי

מגניב אני אשחק עם זה קצת

תודה!

11:25
Adys

מסך ראשי הכי קשה

11:26
shahaf

כן לגמרי

11:26
· +1 short messages
Next thread איתמר, אם הסשן היום מתחיל להישמע כאילו הוא דיבג את עצמו עם ק