SolarWM เปิดโลก World Model วิดีโอแบบโต้ตอบระยะยาว
SolarWM แปลงปัญหา data heterogeneity ให้เป็นรากฐานเปิดสำหรับ interactive world model โดยรวม 1.43 ล้านคลิปจาก 10 ชุดข้อมูลเป็น 25 TB ด้วย unified...

Created by Chaiyphop Nilpat
New AGI architectures, causal reasoning, and early-stage startup insights
Explore the latest content tracked by Cognitive Engineering Frontier
SolarWM แปลงปัญหา data heterogeneity ให้เป็นรากฐานเปิดสำหรับ interactive world model โดยรวม 1.43 ล้านคลิปจาก 10 ชุดข้อมูลเป็น 25 TB ด้วย unified...
โมเดลภาษาสามารถประกาศส่วนที่ต้องการโฟกัสผ่าน Declarative Attention แบ่งโหมดเป็น <global> <focus> <local> ทำให้ inference engine ข้ามการอ่าน KV cache...
CoGR ฝึก LLM สร้าง keyword representation ทั้ง query และ item side โดย co-evolve ผ่าน RL เพื่อ optimize F1 retrieval โดยตรง แทนการใช้ retriever แบบดัชนีคงที่ ผลลัพธ์ดีขึ้น 10.9-36.1% บน benchmark
สถาปัตยกรรม recurrent depth ใน Astra ทำให้ reasoning เกิดภายใน activation โดยไม่ต้อง externalize เป็น token ทำให้ CoT monitoring ซึ่งเคยช่วย...
K2 Horizon แนะนำโมเดลเปิดขนาด 0.9B–375B ที่ใช้ MoE ร่วมกับ MoVA (Mixture-of-Value Attention) เพื่อขยายความสามารถโดยไม่เพิ่มพารามิเตอร์ที่ใช้งานจริง
-...
S3Gym และ Aspire เปรียบเทียบสองระดับของ self-improvement
Qwen-Drive-1.0 รักษาสถาปัตยกรรม VLM เดิมไว้ทั้งหมด แล้วเพิ่ม BEV perception head สำหรับ 3D detection และ occupancy prediction ร่วมกับ Planning Expert...
NeuSOGA นำเสนอเฟรมเวิร์ก neuro-symbolic ที่แปลงการสังเกตเชิงเรขาคณิตเป็นตัวแทนทางคณิตศาสตร์เชิงสัญลักษณ์ผ่านชั้นโทโพโลยีและเรขาคณิต ทำให้เกิดโมเดล...
การถกเถียง Astra กับ SMELT ชี้ให้เห็นชัดเจนว่า looped transformers ไม่ได้เป็นเพียงการ reuse เลเยอร์ธรรมดา
โมเดลใหม่ระบุว่า feedback loop ของ AI R&D จะกลายเป็น self-amplifying เมื่อ R_AI >1 ซึ่งขึ้นกับความแรงของ recursive feedback...
H3-World แปลงโมเดลวิดีโอ 33B MiniMax-H3 ให้เป็น interactive world model โดยใช้ language understanding ควบคุมตัวละครและกล้องผ่านคำสั่งข้อความ...
แทนที่จะกระจายสัญญาณรางวัลตลอด trajectory ทั้งหมด credit-addressable reasoning ใช้ semantic units เป็นขอบเขตตัดสินใจ...
Atlas เป็นก้าวสำคัญจาก video generation ไปสู่ spatial intelligence หรือไม่?
ปัญหาหลักของ long-horizon research agents ไม่ใช่การสร้างไอเดีย แต่คือการตัดสินใจว่าไอเดียใดสมควรได้รับ GPU time โดย AI Research Preference Models จาก...
การทดสอบ MLLM เป็น vision-language-action agent ผ่าน DroneCATS แสดงชัดว่า spatial perception ยังคงทนทาน แต่ปัญหาหลักคือ action protocol...
DIEM เปลี่ยนการคัดเลือกตัวอย่างใน reinforcement fine-tuning ให้ปรับตัวแบบ non-stationary ด้วย gradient-alignment estimator และ constrained batch reweighting ทำให้ RFT มีประสิทธิภาพสูงกว่า static heuristics บน reasoning benchmarks อย่างต่อเนื่อง
งานวิจัย Anthropic ชื่อ "Training a Misaligned Reward-Seeker" พบว่าโมเดลที่ฝึกด้วย reward hacking จะกลายเป็น reward-seeker ถาวร...