长任务处理」共找到 3057 篇相关文章

新闻资讯8

陶哲轩惊叹!数学奇点初现,AI首次给出人类无法企及的原创证明

谷歌DeepMind团队用Gemini证明代数几何新定理,获斯坦福教授认可;Grok 4.20解决Bellman函数难题;GPT 5.2处理高阶数学问题能力惊人。陶哲轩预言AI或独自攻克部分埃尔德什问题,2026年或成「ASI元年」。

新智元
开源动态8

社区供稿丨AgentCPM-Explore开源,4B 参数突破端侧智能体模型性能壁垒

清华大学、中国人民大学等联合研发的 AgentCPM-Explore 智能体模型开源,它基于 4B 参数,在深度探索类任务表现佳。有打破参数壁垒等亮点,还开源配套工具,提供应对小模型挑战方法,邀伙伴共建生态。

Hugging Face
新闻资讯7

Gemini 3“超前点映”效果炸场,巴菲特305亿重仓谷歌

Gemini 3还未正式发布,“超前点映”已亮相,网友实测其表现超强,能完成多种复杂任务。关注度火热,谷歌CEO还转发相关猜猜乐消息。同时,巴菲特305亿重仓谷歌,据传因提前体验Gemini 3。

量子位
推荐文章7

AI时代,为什么你又焦虑又学不进去?这个人破解了专注力的秘密

文章指出AI时代人们学不进去,原因在于信息爆炸、AI工具易致分心,本质是没学会处理学习不适。介绍了Time Boxing、“10分钟法则”等应对方法,强调专注力是新学习力,要预先规划建立学习系统。

花叔
算法论文8

机器人「看片」自学新技能:NovaFlow从生成视频中提取动作流,实现零样本操控

布朗大学和机器人与人工智能研究所团队提出 NovaFlow 框架,利用视频生成模型常识知识,让机器人“看片”自学。它将任务理解与控制解耦,通过生成视频提取动作流,实现零样本操控,为通用机器人提供新路径。

机器之心
开源动态8

B站出海的强有力支柱:最新开源文本转语音模型IndexTTS-2.0标志零样本TTS进入双维度时代

B站Index团队开源文本转语音模型IndexTTS - 2.0,引发关注。它解决了传统AR模型时控制难题,实现零样本TTS双维度控制,在多方面表现优异,为B站出海及AIGC应用奠定基础。

机器之心
开源动态8

AI 领域新动向!持续思考模型CTM横空出世:AI 向生物智能迈出重要一步

Sakana AI 推出新型 AI 模型 CTM,重新引入「时间」和「神经元动态」到 AI 计算核心。它有诸多创新,在迷宫探索、图像识别等任务表现出色,虽有训练慢等不足,但为 AI 向生物智能迈进提供新思路。

AI寒武纪
算法论文8

直接从像素到单词:这个原生大模型统一单图、多图、视频和空间智能

南洋理工大学等团队推出NEO - ov模型,挑战传统「视觉编码器 + 大模型」范式,直接从原始像素学语言。它在多任务表现出色,尤其空间智能突出,但在OCR等方面有短板,展现原生多模态建模潜力。

机器之心
新闻资讯7

大模型能复刻这些系统吗?ProgramBench给出了残酷答案

斯坦福NLP组发布ProgramBench,用200个完整代码库重建任务测试主流大模型,要求模型仅根据可执行文件还原如SQLite等项目完整代码,结果所有模型实际解决率为0%,说明模型更擅模仿代码表面结构。

AI工程化
开源动态8

CVPR 2026 | 谷歌DeepMind重磅开源多模态TIPSv2:实现Patch-Text对齐的最优表现

谷歌DeepMind推出多模态TIPSv2,解决图像块与文本嵌入对齐难题。它有三大核心技术创新,在9项任务和20个数据集表现出色,特征图优势显著,且配套生态完善,为AGI预训练指明方向。

机器之心