Oko Theorem.chat
Theorem.chat takes a mathematical claim and tries to settle it. You state the claim, and the standard it has to meet. A panel of AI models — as many as you want, from whichever vendors you want — attacks it, and one more model referees. Then the argument is formalised in Lean 4 against Mathlib, and the Lean kernel decides whether it is proved. That last step is the product.
Zašto jezgra, a ne drugi model
Postavite model teško pitanje i dobiti tečno odgovor je li to u redu ili ne. Pitajte nekoliko i oni se često slažu, što se osjeća kao potvrda i nije: modeli dijele podatke o treningu i dijele slijepe točke. Drugi model provjere prvi je još uvijek ista vrsta procjene, i to se može govoriti krug. Lean jezgra ne može. Ili izvodi izjava iz aksioma i Mathlib, ili ne, i samopouzdanje nema utjecaja na ishod.
Uobičajeni načini za lažiranje formalnog dokaza su provjereni i odbijeni. Dokaz koji ostavlja rupu s sorry, jedan koji se poziva na native_decide da se jezgra uzeti račun na povjerenje, ili onaj koji tiho uvodi novi aksiom, je otkriven i odbačen umjesto da se smatra uspjehom.
Što ploča zapravo može učiniti
Arguing is the cheap part. The panel works with the literature — arXiv, OpenAlex, Crossref — so a known result is cited rather than re-derived badly. It has SageMath and PARI/GP for computation, Z3 and CVC5 for SMT solving, OEIS lookup for identifying a sequence it has constructed, and a sandboxed Python environment with no network access. A conjecture can be tested against ten thousand cases before anyone spends a round trying to prove it, and a counterexample ends the discussion immediately.
Dokazi, ne govornost
Utakmica nije postignuta na kvaliteti argumenta. Tvrtka se razgraničava u kriterije prihvaćanja, a kriterij se rješava samo kada nešto iza njega može ponovno provjeriti treća osoba: izvor s relevantnim propisom citiranim, ili kod koji je zapravo izvršen s pravim rezultatom. Sudac ponovno provjerava da je sam dokaz prije odluke, i ne može proglasiti da je utakmica završena dok je kriterij još uvijek otvoren.
Ti si postavio šank.
Standardni je vaš izbor, a sudac ga drži doslovno. Pitajte za ono što pažljivi stručnjak bi prihvatio i da dobijete. Tražite potpunu deduktivnu argument s svakom navedenom pretpostavkom i dobiti suđenje protiv toga. Pitajte za bar podnošenje nagrade će se suočiti, a pošten ishod je obično precizan račun gdje ploča pao kratko - što je vrijedan više nego samopouzdano tvrdnje da bi se provjeriti u svakom slučaju.
Da bude jasno o tome: ovo nije stroj koji rješava otvorene probleme. To je stroj koji odbija pustiti argument proći kao rješen kada nije, i to vam govori točno koji korak nije uspio.
Propala formalizacija je korisna izlaz
Kada Lean neće zatvoriti dokaz, dobiti točan cilj koji ostaje. U praksi je gotovo uvijek mjesto gdje je neformalni argument je ručno valjanje – korak svi čitanje proze verzija bi imati klimnuo prošlost. Taj cilj je zatim predan na bilo mjesto je najbolje mjesto za napad, zajedno s što je već iskušano, i ništa drugo. Modeli thring kada su zaglavili, restauriraju sami sebe po punoj cijeni; prolazi jedno posebno pitanje umjesto toga obično unbloks za dio žetona.
Dug posao preživi
Svaka lema ploča ulazi u zajedničku knjigu sa svojim dokazom, tako da rezultati su napisane jednom i nikada ponovno-napravljen, i ćorsoki krajevi su snimljeni tako da nitko ne ulazi natrag u njih. Poklapa se s poslužitelja i pauzirati čisto — na proračunu, na pružatelja ispada, ili zato što ste zatvorili karticu – i nastaviti točno gdje su stajali.
Što nije za ovo?
Teorema je deduktivna riječ. Ova stranica je izgrađena za matematiku, logiku, teoretsku računalnu znanost, teoretsku fiziku i ekonomsku teoriju – polja gdje je tvrdnja rješena dokazom. Empirična pitanja u biologiji, medicini, kemiji ili socijalnim znanostima ne proizvodi teoreme, oni proizvode nalaze, i nema količine formalnosti će ih odlučiti. Naša sestra stranica referee.chat vodi isti panel-i-referee proces bez Lean korak, za točno ta pitanja.