Колишній дослідник AlphaGo заявив, що мовні моделі не здатні до справжнього міркування
Don’t be fooled—LLMs don’t reason
Торе Грепель, колишній керівник напряму машинного навчання в Google DeepMind і учасник команди AlphaGo, стверджує, що великі мовні моделі лише імітують міркування, а не здійснюють його насправді. За його словами, на відміну від AlphaGo, яка явно будувала й оцінювала дерево можливих ходів, сучасні LLM просто передбачають наступний токен і не мають стійкого, перевірюваного стану знань. Він залишив DeepMind, щоб розробити нову архітектуру машинного міркування, яка поєднує інтуїцію нейромереж із явним контрольованим процесом перевірки гіпотез.
Мовою оригіналу · EN
Thore Graepel, former AlphaGo team member and machine learning chair who recently left Google DeepMind, argues that large language models merely mimic reasoning through next-token prediction rather…
Читати оригінал на MIT Technology Review →
Чому в стрічці: Експертний аналіз обмежень міркування LLM від колишнього члена команди AlphaGo — у центрі інтересу до AI.