Asi Theorem.chat

Theorem.chat má matematické tvrzení a snaží se jej urovnat.Uveďte nárok, a standard, který musí splňovat. Panel modelů AI? kolik chcete, od toho, co prodejce chcete? útočí, a jeden další model rozhodčích. Pak argument je formalizován v Lean 4 proti Mathlib, a Lean jádro rozhodne, zda je prokázáno.

Proč jádro, a ne další model

Zeptejte se modelu na tvrdou otázku a dostanete plynulou odpověď, zda je to správné. Zeptejte se několika a často souhlasí, který cítí jako potvrzení a není: modely sdílet údaje o školení a sdílet slepé skvrny. Druhý model kontroly první je stále stejný druh úsudku, a to může být diskutován. Lean jádro nemůže. Buďto vyplývá z prohlášení axiomy a Mathlib, nebo to není, a důvěra nemá žádný vliv na výsledek.

Obvyklé způsoby, jak předstírat formální důkaz jsou kontrolovány a odmítnuty. Důkaz, že opustí díru s sorry, který se odvolává na native_decide, aby jádro vzít výpočet důvěry, nebo ten, který tiše zavádí nový axiom, je detekován a odmítnut, spíše než počítal jako úspěch.

Co může panel skutečně udělat

Hádka je levná část. Panel pracuje s literaturou Ş arXiv, OpenAlex, Crossref Ş tak známý výsledek je citován spíše než re-vyvozil špatně. Má SageMath a PARI/GP pro výpočty, Z3 a CVC5 pro SMT řešení, OEIS hledat pro identifikaci posloupnosti, kterou postavil, a písečný Python prostředí bez přístupu k síti. Dohady lze otestovat proti deseti tisícům případů, než někdo stráví kolo snaží dokázat, a protipříklad končí diskusi okamžitě.

Důkazy, ne výmluvnost

Zápas není vstřelen do kvality argumentu. Tvrzení je rozloženo do kritérií pro přijetí a kritérium je urovnáno pouze tehdy, když něco za ním může být znovu kontrolováno třetí stranou: zdroj s příslušnou kolonkou citovanou, nebo kód, který byl skutečně proveden s jeho skutečným výstupem. Rozhodčí znovu zkontroluje, že důkazy, které sám před rozhodnutím, a nemůže prohlásit zápas dokončen, zatímco kritérium je stále otevřené.

Ty jsi nastavil bar.

Standard je vaše volba, a rozhodčí drží to doslova. Zeptejte se, co by opatrný odborník přijmout a dostanete to. Požádejte o kompletní deduktivní argument s každým uvedeným předpokladem a dostanete souzeno proti tomu místo. Požádejte o baru podání ceny by čelit, a upřímný výsledek je obvykle přesný účet, kde panel klesl krátký?, který je cennější než sebevědomý nárok, budete muset zkontrolovat sami tak jako tak.

Abych to řekl jasně: není to stroj, který řeší otevřené problémy. Je to stroj, který odmítá nechat argument projít, jako je vyřešena, když není, a to vám přesně říká, který krok selhal.

Neúspěšná formalizace je užitečný výstup

Když Lean nebude zavřít důkaz, dostanete přesný cíl, který zůstává. V praxi, že je téměř vždy místo, kde neformální argument byl ručně-vlnění? Krok každý čtení prózy verze by přikývl minulost. Tento cíl je pak předán, který sedadlo je nejlépe umístěn k útoku, spolu s tím, co již bylo vyzkoušeno, a nic jiného. Modely thrash, když jsou zasekl, přestavování sami za plnou cenu; průchod jednu konkrétní otázku místo obvykle odblokuje na zlomek žetonů.

Dlouhá práce přežívá

Každý lemma panel stanoví jde do sdílené účetní knihy s jeho důkazem, takže výsledky jsou napsány jednou a nikdy znovu-získané, a slepé uličky jsou zaznamenány, takže nikdo vejde zpět do nich. Matches běží server-strana a pauza čistě o rozpočtu, na poskytovatele výpadek, nebo proto, že jste uzavřeli kartu? a obnovit přesně tam, kde se zastavili.

Na co to není?

Věta je deduktivní slovo. Tato stránka je postavena pro matematiku, logiku, teoretické informatiky, teoretické fyziky a ekonomické teorie? Oblasti, kde nárok je řešena důkazem. Empirické otázky v biologii, medicíně, chemii nebo společenských věd neprodukují věty, produkují nálezy, a žádné množství formalizace bude rozhodovat o nich. Naše sestra stránky referee.chat běží stejný panel-a-souřadatelský proces bez Lean krok, pro přesně tyto otázky.

referee.chat? stejný nápad, pro empirická tvrzení

Theorem.chat je provozováno Muddy Holdings LLC. Ozvi se..