认知几何学」共找到 742 篇相关文章

新闻资讯8

Nature公开谷歌IMO金牌模型技术细节!核心团队仅10人,一年给AI编出8000万道数题训练

谷歌DeepMind的IMO金牌模型AlphaProof技术细节公开。团队规模小,核心成员是IMO金牌得主。它把数证明当游戏,用30亿参数模型和改进树搜索算法。训练难题靠自动形式化解决,赛场用TTRL突破,已开放使用。

量子位
算法论文8

DeepMind爆火论文:向量嵌入模型存在数上限,Scaling laws放缓实锤?

DeepMind一篇关于向量嵌入局限性的论文在AlphaXiv爆火。其证明向量嵌入有数上限,Scaling laws或放缓。研究构建LIMIT数据集,测试发现即便是先进嵌入模型也难解决简单任务,揭示了RAG系统约束,让人反思Scaling Laws边界。

机器之心
开源动态8

阿里 Qwen3:持续开源,SOTA 连连!

很多从业者有‘闭源模型一定比开源强’的刻板印象,而 Qwen 正打破此认知。最近阿里连发三款模型 Qwen3-235B、Qwen3-Coder、Qwen3-235B(Thinking),在多方向发力且拿下多个开源榜单第一。

特工宇宙
新闻资讯7

不会被AI替代?100年前的农民也这么想的,这些图表让你害怕!

文章指出没有工作能逃过AI替代命运,以农业、制造业岗位变化为例,说明AI将使人力需求减半。微软和谷歌超30%代码由AI编写,还提到人们对AI威胁认知不足,探讨了AI时代谁是受益者等问题。

新智元
算法论文8

PPO-Clip的「盲点」被补齐了?快手提出熵比裁剪方法,从局部约束到全局稳定的关键一跃

快手科技语言大模型团队提出熵比裁剪(ERC)方法,应对强化习中信任域偏离问题。该方法从全局视角稳定策略分布,在多个数推理基准实验中提升了模型性能,还与多种方法对比验证了泛化能力。

机器之心
新闻资讯8

陶哲轩亲测!GPT-5 Pro 40分钟破解3年难题,登顶最难数考试

家陶哲轩将几何难题交给GPT - 5 Pro,虽推理完美但无解。同一周,GPT - 5 Pro在FrontierMath测试集夺冠。陶哲轩测试发现AI在科研不同层面表现有别,也揭示了AI理解力受限及人类与AI的分工边界。

新智元
算法论文8

Thinking Machines新发现:Lora不是权宜之计,哪怕秩低到 1,也能匹敌全参数微调

Thinking Machines和John Schulman新研究刷新对LoRA的认知,实验显示正确使用时它能匹敌全量微调。团队系统研究训练集与参数关系,有层选择、习率等关键发现,还给出实用建议,但LoRA在部分场景表现待验证。

AI工程化
算法论文8

腾讯AI Lab首创RL框架Parallel-R1,教大模型会「并行思维」

腾讯AI Lab等机构研究者首创Parallel - R1框架,通过强化习让大模型掌握并行思维。它解决了RL训练的冷启动和奖励设计难题,在多数基准上提升准确率,还揭示模型思维策略变化及并行思维的‘脚手架’作用。

机器之心
新闻资讯8

AI上清北,普通人该怎么办?|甲子光年

2025年AI模拟高考成绩达清北线,引发对人类努力意义的思考。三位嘉宾围绕AI能力进步、与人类能力差异、对教育和创作的影响等展开对谈,探讨人类在AI时代的定位、专业选择、教育变革等问题。

甲子光年
推荐文章7

618想换电脑跑AI?先听我一句劝。

文章围绕618换电脑跑AI展开,分析了本地跑AI的情况,包括不同模型对算力和显存的要求,指出本地跑的好处是隐私安全、无限免费,还推荐了不同预算的笔记本,为想换电脑AI的人提供参考。

数字生命卡兹克