模型不可知」共找到 8476 篇相关文章

新闻资讯8

Gemini证明数学新定理!全程没联网

Gemini内部数学版学霸模型FullProof全程联网,帮数学家证明代数几何领域新定理,即0亏格映射到旗簇空间的motivic类等价结论。它埋下关键思路伏笔、独立给出反例,比Macaulay2更优。

量子位
算法论文8

怕乱引文献!绕过付费墙,BibAgent把学术核验转为证据链

模型生成学术论述,其引用验证成难题,尤其付费墙后论文难以核验。BIBAGENT突破此困境,破解付费墙也能验证引文语义真伪,还构建MISCITEBENCH评测,表现优异,为科学写作补“可审计基础设施”。

新智元
算法论文8

大突破!实验证明,RL能为LLM注入“创新”能力

此研究挑战‘RL教新技能’观点,通过‘字符串转换预测’实验证明,RL能让LLM学会组合已有原子技能,形成可泛化、迁移的元技能,还给出模型能力提升路径。

深度学习自然语言处理
新闻资讯7

Claude降智,是自杀还是装死?

AMD AI总监实锤Claude Code降智,BridgeBench报告显示Claude Opus 4.6排名下降、准确率降低、幻觉率增加。但Anthropic疑似在测试全栈应用构建系统,或在意模型排名,更关注平台生态。

新智元
新闻资讯7

小扎“亿元俱乐部”刚组就被拆!千人AI团队面临裁员,高管也得走

Meta 6个月内第4次重组AI部门,超级智能实验室一拆四。市场认可,股价连跌。过有分析师认为体现扎克伯格决心。此次变动暗藏裁员,公司还考虑用第三方模型

量子位
新闻资讯7

GPT-5-Thinking新训练方法公开:让AI学会忏悔

OpenAI提出忏悔训练Confessions,让ChatGPT自己“坦白从宽”。在GPT - 5 - Thinking上实验有效,模型犯错后多会坦白,且更诚实,影响原任务表现。还介绍了训练方法、实验结果及局限性。

量子位
推荐文章7

我写 nano banana pro 提示词时的原则和策略

作者分享写 nano banana pro 提示词的原则与策略,原则是做成模板、结合模型能力;策略是先跑通原型再抽象成模板;过度精简提示词,还介绍用 GPT-5.1 等工具辅助。

宝玉AI
开源动态8

我们对 Coding Agent 的评测,可能搞错了方向

用户对 Agent 满常因它「做得好」,遵循指令和规范。当前主流评测体系以结果为导向,与真实场景错位。MiniMax 开源 OctoCodingBench 评测集,结果显示模型过程规范遵循足,未来训练需引入过程监督。

Founder Park
7

IMO怒斥OpenAI自封夺金,“91位评委均未参与评分”,网友:炒作无下限

OpenAI宣称新模型获IMO金牌到24小时剧情反转,多位官方人士和大佬指其做法“粗鲁且恰当”。其“金牌”成绩或站住脚,未与官方合作,无评委参与评估。此事引发学术道德和商业炒作争论。

量子位
推荐文章7

中美 NeoLab 对话:模型和 Agent 如何实现「持续学习」?

在新加坡 AGI Playground 2026 舞台上,AMI Labs 林敏和 Mind Lab Andrew Chen 深度对谈,探讨 Agent 如何将经验转化为能力、持续学习。两人对持续学习给出同答案,还讨论记忆、学习等基础问题及解决办法。

Founder Park