研究揭示 Claude Opus 5.5 与 GPT 模型的 AI 写作“破绽”
Graphite 研究发现,Claude Opus 5.5 最爱说“this matters”,出现频率是人类的 116 倍,而 OpenAI 的 Astra 则偏好“not simply X”式的纠正性框架,频率超人类 100 倍。
Graphite 研究发现,Claude Opus 5.5 最爱说“this matters”,出现频率是人类的 116 倍,而 OpenAI 的 Astra 则偏好“not simply X”式的纠正性框架,频率超人类 100 倍。
研究提出 Image-to-Code 方法,让编码智能体从单张照片迭代编写可执行的 Blender 程序,并配套发布 LEGO-Bench 基准,包含 104 个室内外场景的 208 张图像和 443 个注册资产。
Google 发布新一代联邦学习系统,利用可信执行环境(TEE)为数据匿名化提供可验证、可审计的保证,并已用于 Gboard 的英语和日语下一词预测模型。新系统将客户端梯度计算转移到服务端,训练时间从过去的 1-2 个月大幅缩短,瓶颈转为 TEE 资源可用性。
推荐理由:Google 公布基于 TEE 的新一代联邦学习系统设计,读者可了解其隐私验证机制与 Gboard 落地效果。
卡内基梅隆、MIT、纽约大学和斯坦福的研究团队开发的 AI Ataraxos 以 15 胜 1 负 4 平击败被视为史上最强 Stratego 选手 Pim Niemeijer,训练仅用 16 块 GPU 和几千美元。
一项新研究提出用"分治"范式替代时序差分(TD)学习来做 off-policy 强化学习,通过将轨迹一分为二、组合两段价值来更新整体价值,理论上把 Bellman 递归次数从线性降到对数级。该方法在 goal-conditioned RL 中实现了可扩展的分治价值学习,作者称这是首个将分治价值学习扩展到高复杂度任务的工作。相比 n-step TD,它无需调 n 超参,也不必然带来高方差或次优性。
伯克利 AI 研究团队证明,在初始化接近零、梯度步长极小等温和近似条件下,word2vec 的学习问题可化简为无权重最小二乘矩阵分解,其梯度流动力学有闭式解,最终学到的表示等价于对目标矩阵 M* 做 PCA。训练中模型按离散步骤逐个学习正交线性子空间,每步提升嵌入矩阵的秩并降低损失,这些特征即 M* 的顶部特征向量,可由语料统计和超参数预先算出。