新闻资讯7
GPT之父用1930年数据训练Talkie模型
机器之心
AI 摘要
GPT之父Alec Radford等训练Talkie模型,用1931年前数据。测试发现它能学编程,且与现代孪生模型有差距。训练中遇时间泄漏、数据质量等问题,下一步想让模型自审。
阅读原文 · 机器之心
哈萨比斯出的难题,GPT之父接上了:用一个知识停在1930年的模型
GPT之父Alec Radford等用1931年前数据训练13B模型Talkie,切断现代知识污染。研究者测试其能力,探讨它对未来的“预感”、规避污染问题及数据多样性等,同时训练中也面临时间泄漏、数据质量等难题。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
新闻资讯8
Opus 5通关测试:强模型需简单环境
ARC Prize官方给Opus 5的ARC - AGI - 3成绩为30.2%,但开发者Jeremy Berman让其借助电脑,正确率飙升至96.2%。还开源代码,换用Codex等测试效果差。表明模型强时,简单环境更佳。
新智元
新闻资讯7
三款LLM新品发布,社区实测性能大比拼
LLM大爆发,一天内推出Grok 4.6、Qwen3.8 - Max、DeepSeek - V4 - Pro - 0813三款前沿产品。社区对它们进行多场景测试,如3D场景、Flappy游戏、飞机滑行动画等,并对比了不同模型的性能、价格和输出质量。
PaperAgent
推荐文章7
烧钱评测:国模格局或改写
作者花大成本从后端、人味、前端、推理等维度,对glm 5.2、kimi k3等国产模型进行测试,展示各模型在不同测试中的结果,指出国模2T俱乐部的kimi和qwen下限高,且刻板印象需改变。
探索AGI
产品应用7
GLM - 5.2测试表现出色,比肩闭源旗舰
作者对GLM - 5.2、Opus 4.8和GPT 5.5进行两项测试。一是审计Skill体系,GLM - 5.2覆盖skill数多、找出冲突多,还挖出bug;二是做世界杯夺冠推演器网站,Opus表现出色,GLM - 5.2省token,Codex有巧思但结构有缺陷。
AI产品黄叔