基础模型 第6页

Recursive Language Models

打破上下文诅咒:递归语言模型(RLM)让GPT-5处理无限长文本。本文系统梳理其研究背景、核心方法、关键实验结果、现有局限以及后续工程实践启示。

Step-DeepResearch Technical Report

32B模型媲美OpenAI?Step-DeepResearch揭秘:低成本实现专家级深度研究。本文系统梳理其研究背景、核心方法、关键实验结果、现有局限以及后续工程实践启示。

Step-GUI Technical Report

成本暴降100倍!Step-GUI刷新SOTA,打造手机端最强“操作员”。本文系统梳理其研究背景、核心方法、关键实验结果、现有局限以及后续工程实践启示。

Towards Execution-Grounded Automated AI Research

斯坦福自动化AI科研:10轮进化准确率飙升21%,RL反而“变笨”?。本文系统梳理其研究背景、核心方法、关键实验结果、现有局限以及后续工程实践启示。

Transformers learn factored representations

Transformer的世界观:自动将指数级复杂世界拆解为线性正交因子。本文系统梳理其研究背景、核心方法、关键实验结果、现有局限以及后续工程实践启示。

Web World Models

Web World Model:用普通代码构建“物理法则”,让LLM只负责“想象”。本文系统梳理其研究背景、核心方法、关键实验结果、现有局限以及后续工程实践启示。

Stronger Normalization-Free Transformers

告别LayerNorm?CMU提出Derf:仅用简单函数,多模态性能全面超越。本文系统梳理其研究背景、核心方法、关键实验结果、现有局限以及后续工程实践启示。

The 2025 Foundation Model Transparency Index

2025 AI透明度大倒退:均分跌至40,IBM夺冠,xAI与Midjourney垫底。本文系统梳理其研究背景、核心方法、关键实验结果、现有局限以及后续工程实践启示。