「智能研究」共找到 4965 篇相关文章
开源项目 | 用自然语言做视频剪辑,人人都能用的 AI 视频剪辑工具
FireRed - OpenStoryline是开源AI视频剪辑智能体,理念是‘你说话,它剪片’。工作流程为‘理解→执行→输出’。具备智能素材搜索、文案生成等多项能力,适用于多场景,介绍了安装方式、优缺点。
750篇论文,彻底把统一多模态模型摸清了
未来迈向AGI需多模态AI系统。南大等联合发表综述,涵盖754篇文献。分析传统路线痛点,介绍统一多模态模型定义、技术路线、训练方法等,还提及应用场景及未来方向。
OpenAI 收购了自己的“甲方”公司
当地时间12月3日,OpenAI宣布收购Neptune.ai,该公司为企业提供AI模型训练跟踪工具,OpenAI本就是其客户。虽未披露财务条款,但报道称将以不到4亿美元股票支付,交易仍需满足成交条件。
大模型如何"不训练"也能学习?——上下文学习的隐式权重更新机制
大型语言模型能通过上下文学习(ICL)在推理时即时学习新任务,无需修改模型参数。本文首次证明自注意力层与MLP层组合能隐式将上下文信息转为MLP层低秩权重更新,解释了ICL原理,为构建AI系统开辟新路径。
英伟达把8个AI和8台机器人关在一起,它们学会了自己做实验
英伟达高级研究科学家公布“ENPIRE”项目,8个AI与8台机器人组成科研团队,能自主做实验。研究测试三种coding agent,Codex表现最佳。系统分两阶段,虽有局限但有新发现。
Anthropic:大模型开始意识到自己在想什么!
Anthropic的Jack Lindsey论文《Emergent Introspective Awareness in Large Language Models》对大模型做神经科学受控实验。发现Claude Opus 4/4.1能感知内部念头,区分内外状态,通过检查内部状态一致性判断输出意图。
Apple发布新SOTA Manzano:混合Tokenizer破解多模态统一难题,理解与生成双翼齐飞
多模态AI前景广,但现有模型在理解和生成任务上存在性能冲突。苹果提出Manzano模型,用混合视觉标记器降低任务冲突,结构简单可扩展,在多基准测试达SoTA水平,还展示图像编辑潜力。
GitNexus 开源代码库知识图谱引擎,效果惊艳!
GitNexus 是在浏览器运行的客户端代码智能工具,能将代码库转化为知识图谱,内置 RAG 智能代理。有 CLI + MCP 和 Web UI 两种使用方式,支持多种主流语言,还提供详细文档。
GPT-5都救不了的AI幻觉,原来问题不在模型,在“考卷”
OpenAI研究指出AI产生幻觉的根本原因是评估和激励机制有问题。现有训练和评估流程奖励‘猜测’,导致模型易产生幻觉。研究还给出解决方案,要更新‘考试规则’,让模型适当表达不确定。
让AI读懂「言外之意」:AI4SG团队发布首个心理健康污名语料库,破解隐性偏见识别难题
心理健康患者常面临社会偏见,且这种污名化隐蔽难识别。新加坡国立大学AI4SG团队联合多学科专家,构建首个心理健康污名访谈语料库MHStigmaInterview,获ACL 2025认可,为解决该社会问题提供技术支持。