「持续自我提升式 AI」共找到 11565 篇相关文章

算法论文8

DMLR 2026 | RPI Shaowu Pan(潘韶武)团队 Nithin Somasekharan等:CFDLLMBench——首个面向计算流体力学的大语言模型综合基准评测

文章介绍针对CFD领域的综合LLM评测基准CFDLLMBench,构建三层递进挑战体系。实验揭示主流LLM在‘知道’与‘做到’间有差距,多智能体框架可提升成功率,代码与数据集已开源。

力学与人工智能
算法论文8

结构化扩展拿下Agent工具检索新SOTA,精准找到API|ICLR'26

宁波东方理工大学沈晓宇团队在ICLR 2026发表论文,指出当前工具检索瓶颈在于工具文档。提出对文档结构化扩展,再训练模型的方案,构建TOOL - REX等组件,实验显示显著提升检索性能。

量子位
新闻资讯7

谷歌430万颗TPU暴击CUDA护城河!Meta「割肉」助攻

Global Semi Research研究显示,2026年谷歌TPU总产能将达430万颗,主要因Meta释放CoWoS产能及台积电扩充产能。这显示谷歌欲降低成本、挑战英伟达,也预示AI巨头重塑算力格局。

新智元
新闻资讯7

布林坦承谷歌低估Transformer,“还被OpenAI挖走了Ilya”

谷歌创始人谢尔盖・布林回母校演讲,复盘谷歌发展,承认曾低估Transformer,让机会给OpenAI。还回顾谷歌诞生、AI掉队又靠Gemini 3翻盘的历程,给出对大学生、创业者建议,反思退休决定。

量子位
开源动态8

「豆包手机」被智谱开源了,AutoGLM 实测

豆包手机发布后火爆,智谱开源AutoGLM,能让安卓手机变「AI手机」。作者实测,它能完成点外卖、比价等任务,设计贴心尊重隐私。适合开发者、效率爱好者等,还会推动Phone Agent生态发展。

特工宇宙
开源动态8

不看后悔!GitHub 开源 MultiTalk .8k star 强大的人语音+图像绑定项目

MultiTalk 是 MeiGen‑AI 开发的开源框架,可从音频、图片和提示语生成多人对话视频。它解决传统视频制作痛点,功能亮点多,技术优势明显,应用场景广,与同类项目对比表现突出。

小华同学ai
开源动态8

终于开源升级OmniGen2,统一多模态图像生成模型,真的惊艳。

OmniGen2是强大的开源统一多模态图像生成模型,针对文本和图像模态构建独立解码路径,运用未共享参数。新架构提升处理效率和质量,在图像编辑等任务表现出色,还有多技术特点。

开源AI项目落地
新闻资讯7

Andrej Karpathy 辣评Veo 3:视频生成将直接优化人类的注意力,TikTok只是弟弟

Andrej Karpathy发文对Google的Veo 3视频生成模型发表见解,指出视频生成技术进步带来四个关键转变,认为视频将成AI与人类交流绝佳界面,也引发众人对其利弊的讨论。

AGI Hunt
算法论文7

告别Reasoning模型的“灵光一现”,推理能力可控了

当前GPT - 4o、DeepSeek - R1等大模型推理的‘高级操作’随机触发,不可控。研究者受经典推理三要素启发,教会模型三种‘元能力’,经三阶段训练,模型效果提升,让推理能力可控。

深度学习自然语言处理
开源动态8

手机跑多模态也能快到飞起!面壁MiniCPM-V 4.6开源

面壁智能开源多模态模型MiniCPM-V 4.6,以低算力成本、超低首Token延迟打通三大主流手机操作系统。它算力瘦身性能强,是视觉语言多面手,还适配主流系统,降本增效,让AI能力从云端到指尖。

AIGC开放社区