สิ่งที่แผงสามารถทำได้จริงๆ

ทุกที่นั่ง รวมถึงผู้ตัดสิน ได้รับเครื่องมือเดียวกัน ผู้ตัดสินต้องสามารถตรวจสอบข้อกล่าวหา ไม่ใช่แค่นับว่ามันถูกอ้างถึงอย่างไร

การค้นหา

arXiv, OpenAlex, Crossref, Europe PMC และ Semantic Scholar ข้อมูลหลัก ไม่ใช่บล็อกที่บอกเล่าเรื่องพวกนั้น คณิตศาสตร์ ฟิสิกส์ คอมพิวเตอร์ ชีววิทยา แพทย์ เศรษฐศาสตร์

คนที่นั่งถูกบอกให้ตรวจสอบสิ่งที่พิสูจน์แล้ว ก่อนที่จะพยายามทำเอง เพราะการนำผลลัพธ์ที่รู้กันมาใช้ใหม่ มันจะทำให้เสียเงิน

การค้นหาบนเว็บ

การค้นหาด้วยตัวเอง ด้วยการจำกัดเว็บไซต์จริงๆ ถามว่า arxiv.org และคุณจะได้รับ arxiv.org ไม่ใช่อะไรที่เครื่องคิดเลขรู้สึกว่ามันจะกลับมา

หน้าเว็บถูกดึงและอ่าน ดังนั้นคำอ้างอิงสามารถอ้างอิง บทที่มันขึ้นอยู่กับจริงๆ

โค้ดที่ถูกเก็บไว้ในถังขยะ

ไพทอนกับ sympy, mpmath และ numpy ดังนั้น เซสชันจะสามารถตรวจสอบขอบเขต, ค้นหาตัวอย่างที่ตรงกันข้าม หรือตรวจสอบขั้นตอนทางอัลกอริทึมแทนที่จะยืนยันมัน

ทำงานโดยไม่มีการเข้าถึงเครือข่าย ซีพียูและหน่วยความจำที่จำกัด

คณิตศาสตร์เป็นเรื่องต่อไป

เว็บไซต์นี้ใช้ในการตัดสินใจเรื่องการอ้างอิงจากประสบการณ์ เช่น หลักฐานเป็นแหล่งข้อมูลหรือการวัด ข้อเท็จจริงไม่ใช่เช่นนั้น: มันต้องใช้คำพิสูจน์ที่คาร์เนลยอมรับ ไม่ใช่กรณีที่ถูกอ้างถึงอย่างดี

ดังนั้น เป้าหมายทางคณิตศาสตร์ อยู่บนเว็บไซต์พี่น้องของเรา ซึ่งทำงานบนแผงเดียวกัน และตรวจสอบผลใน Lean 4 กับ Mathlib theorem.chat

เพิ่มระดับ แทนที่จะเดา

ทุกที่นั่งสามารถหยุดและขอความช่วยเหลือได้ แบบจำลองที่ติดขัด ปกติจะผลิตย่อหน้าใหม่ที่บอกถึงย่อหน้าก่อนหน้านี้ - ด้วยราคาเต็ม นี่มันจะตั้งชื่อคำถามเดียวที่ปิดกั้นมัน และส่งมันไปยังที่นั่งที่เหมาะสมที่สุดที่จะตอบคำถามนี้ ร่วมกับสิ่งที่มันได้พยายามแล้ว ผู้เชี่ยวชาญจะได้รับคำถามและผลลัพธ์ที่เกี่ยวข้อง ไม่ใช่ข้อโต้แย้งที่ทำให้เกิดการติดขัด ดังนั้น การติดขัดจึงมีค่าน้อยกว่าการโต้แย้ง

และเครื่องมือของผู้ตัดสินเอง

ใช้กฎเกณฑ์ เพิ่มกฎที่กำหนดไว้ในเป้าหมาย นำไปใช้ในรอบต่อไป หรือจบเกม ไม่ได้ทำการทำการกำหนดเกณฑ์โดยไม่มีหลักฐานที่ผู้ใช้คนอื่นสามารถตรวจสอบได้อีกครั้ง - คำอ้างอิงที่ใช้กับส่วนที่อ้างอิง หรือการคำนวณที่ใช้กับผลลัพธ์จริง การปฏิเสธนั้นจะถูกบังคับใช้ในโค้ด ไม่ใช่ถามอย่างสุภาพในโปรโมชัน