בערך Theorem.chat

Theorem.chat takes a mathematical claim and tries to settle it. You state the claim, and the standard it has to meet. A panel of AI models — as many as you want, from whichever vendors you want — attacks it, and one more model referees. Then the argument is formalised in Lean 4 against Mathlib, and the Lean kernel decides whether it is proved. That last step is the product.

למה גרעין, ולא מודל אחר

שאל מודל שאלה קשה ואתה מקבל תשובה שוטפת האם זה נכון או לא. שאל כמה מהם והם מסכימים לעתים קרובות, אשר מרגישים כמו אימות והוא לא: מודלים חולקים נתונים אימונים ולחלוק כתמים עיוורים. מודל שני בדיקה ראשונה היא עדיין אותו סוג של שיפוט, וזה יכול להיות דיבר עגול. הליבה הנטויה לא יכולה. זה גם נובע מההצהרה מן האקסיומס ו-Mathlib, או זה לא, ולא בטוח אין השפעה על התוצאה.

The usual ways to fake a formal proof are checked for and refused. A proof that leaves a hole with sorry, one that appeals to native_decide to make the kernel take a computation on trust, or one that quietly introduces a new axiom, is detected and rejected rather than counted as a success.

מה הפאנל באמת יכול לעשות

הלוח עובד עם הספרות arXiv, Open Alex, Crossref ▪ Crossref ▪ אז תוצאה ידועה היא במקום re-dived בצורה גרועה. יש לו SageMath ו-PARI/GP עבור חישוב, Z3 ו-CVC5 עבור SMT פתרון, OEIS חיפוש מחדש עבור זיהוי רצף זה בנה, וסביבת פייטון עם גישה לרשת. השערה יכולה להיבחן נגד עשרת אלפים מקרים לפני שמוציאים את הדיון, כדי להוכיח את העימות על מנת לבטל את העימות.

ראיות, לא צנות.

משחק אינו מובקע על איכות הויכוח. הטענה היא רק לפרק לקריטריונים קבלה, וקריטריון הוא התיישב רק כאשר משהו מאחורי זה ניתן לבדוק מחדש על ידי צד שלישי: מקור עם מעבר רלוונטי מצוטט, או קוד אשר הוצא להורג עם התפוקה האמיתית שלה. השופט בודק מחדש את הראיות לפני פסיקה, והוא לא יכול להכריז על המשחק כסגור בעוד הקריטריון פתוח.

אתה קובע את הרף.

אתה יכול לבחור את הסטנדרט, והשופט מחזיק בו פשוטו כמשמעו. בקש מה מומחה זהיר יקבל ואתה מקבל את זה. בקש טיעון דדוקטיבי מלא עם כל הנחה מוצעת

כדי להיות ברור לגבי זה: זו לא מכונה שנותנת לבעיות פתוחות. זו מכונה שמסרבת לאפשר לויכוח לעבור כמוסכם כאשר הוא לא, וזה אומר לך בדיוק איזה צעד נכשל.

פורמליזציה כושלת היא התפוקה המועילה

כאשר ליאן לא תסגור את ההוכחה, תקבלו את המטרה המדויקת שנותרה. בפועל, זה כמעט תמיד המקום שבו הטיעון הלא רשמי היה

עבודה ארוכה שורדת

כל לימה שהלוח קובע נכנסת לספר חשבונות משותף עם ההוכחה שלו, כך שהתוצאות נכתבו פעם אחת ולא שוב, ומבוי סתום מתועדים כך שאף אחד לא חוזר אליהם. גפרורים רצים לצד השרתים ועוצרים באופן נקי על תקציב, על הפסקות ספק, או בגלל שסגרת את החשבון וממשיכים בדיוק היכן שהם עצרו.

מה זה לא עבור

Theorem is a deductive word. This site is built for mathematics, logic, theoretical computer science, theoretical physics and economic theory — fields where a claim is settled by proof. Empirical questions in biology, medicine, chemistry or the social sciences do not produce theorems, they produce findings, and no amount of formalisation will decide them. Our sister site referee.chat runs the same panel-and-referee process without the Lean step, for exactly those questions.

referee.chat □ אותו רעיון, לטענות אמפיריות

Theorem.chat מופעל על ידי Muddy Holdings LLC. צור קשר.