1 Attention Is All You Need | Vaswani, Shazeer, Parmar ועוד (Google Brain) | 2017 | NeurIPS 2017 | למידה עמוקה / NLP | Self-Attention והארכיטקטורה של Transformer | גבוהה (לא לקרוא בלי לוח ומטריצות ליד) | כ-90 דקות | עשרות אלפים, אחד המצוטטים בהיסטוריה | זה כמו לגלות שאפשר לזרוק מכל מקום על המגרש בלי לדרוך על הקו - שינה את כל אופן המשחק. אחרי המאמר הזה כל מה שידעתי על RNN הרגיש כמו סטטיסטיקה מהעונה הקודמת. |
|---|
2 A Few Useful Things to Know about Machine Learning | Pedro Domingos | 2012 | Communications of the ACM | עקרונות יסוד בלמידת מכונה | Overfitting, bias-variance ולמה יותר דאטה כמעט תמיד מנצח | נמוכה-בינונית | כ-30 דקות | אלפים רבים | המאמר הזה הוא כמו זריקות עונשין - משעמם, בסיסי, ובכל זאת רוב האנשים לא עושים אותו נכון. שולח את זה לכל מי שמתחיל בתואר. |
|---|
3 The Unreasonable Effectiveness of Data | Alon Halevy, Peter Norvig, Fernando Pereira | 2009 | IEEE Intelligent Systems | פילוסופיה של דאטה / NLP | מדגם גדול ופשוט מנצח מודל מתוחכם עם מעט דאטה | נמוכה | כ-20 דקות | אלפי ציטוטים | מזכיר לי דיון על sample size בכדורסל - חמישה משחקים טובים לא הופכים שחקן ל-MVP, וגם מודל לא הופך לגאון בלי דאטה אמיתי. |
|---|
4 Deep Residual Learning for Image Recognition | Kaiming He, Xiangyu Zhang, Shaoqing Ren, Jian Sun | 2016 | CVPR 2016 | ראייה ממוחשבת | Residual / skip connections שמאפשרים רשתות עמוקות באמת | גבוהה | כ-60 דקות | מעל 100,000, כנראה מהמצוטטים ביותר אי פעם | ה-skip connection הזה הוא בדיוק כמו מסך טוב (screen) - נותן למידע לעבור גם כשיש הגנה כבדה באמצע. |
|---|
5 The Hot Hand in Basketball | Thomas Gilovich, Robert Vallone, Amos Tversky | 1985 | Cognitive Psychology | פסיכולוגיה קוגניטיבית והסתברות | 'יד חמה' כאשליה של תפיסת רצפים אקראיים | נמוכה-בינונית | כ-40 דקות | אלפי ציטוטים, קלאסיקה בתחום | המאמר שגרם לי לצעוק על המסך אחרי כל צפייה חוזרת ביורוליג - מתברר שהתחושה ש'הוא בוער' היא בעיקר אצלנו, לא אצל הכדור. |
|---|
6 A Starting Point for Analyzing Basketball Statistics | Justin Kubatko, Dean Oliver, Kevin Pelton, Dan Rosenbaum | 2007 | Journal of Quantitative Analysis in Sports | אנליטיקת ספורט | Possessions, Pace ו-Efficiency כבסיס לכל מדד מתקדם | בינונית | כ-50 דקות | מאות עד אלפים | בעצם ה-'ground truth' שממנו כל מדד מתקדם שרואים היום בשידור נולד. קוראים את זה פעם ומפסיקים להתרגש מ-PPG בלי הקשר. |
|---|
7 Random Forests | Leo Breiman | 2001 | Machine Learning (Springer) | למידת מכונה - שיטות ensemble | Bagging + עצי החלטה אקראיים שמצביעים יחד | בינונית | כ-45 דקות | עשרות אלפים | כמו קבוצת רוטציה עמוקה שמנצחת כוכב בודד לאורך עונה - כל עץ בפני עצמו חלש, ביחד הם עקביים בטירוף. |
|---|
8 ImageNet Classification with Deep Convolutional Neural Networks | Alex Krizhevsky, Ilya Sutskever, Geoffrey Hinton | 2012 | NeurIPS 2012 | ראייה ממוחשבת | AlexNet - CNN עמוק שהתאמן על GPU וניצח את תחרות ImageNet | גבוהה-בינונית | כ-50 דקות | עשרות אלפים | כמו דראפט פיק אחד ששינה ליגה שלמה - אחרי המאמר הזה כל מי שעבד על ראייה ממוחשבת עבר לדבר על deep learning. |
|---|