「动物语言研究」共找到 2833 篇相关文章
长达790年视频镜头,打造原生多模态世界模型!北京智源研究院用Emu3.5统一“世界”
北京智源研究院发布并开源基于原生多模态训练的世界学习者Emu3.5,它将视觉和语言视为同一种数据流,在超13万亿token数据上学习,解决长视野多模态信息处理问题,经多阶段训练和优化,能力强大且已开源。
让AI生成视频「又长又快」:Rolling Forcing实现分钟级实时生成
南洋理工大学与腾讯ARC实验室联合研究,由博士生刘坤昊等完成,提出Rolling Forcing方法,通过滚动窗口联合降噪等创新设计,突破实时长视频生成瓶颈,实现分钟级实时生成,还支持交互控制,但仍有优化方向。
首个地球科学智能体Earth-Agent来了,解锁地球观测数据分析新范式
上海人工智能实验室与中山大学联合研发的 Earth - Agent 解决了多模态大语言模型用于地球科学研究的痛点。它将领域知识工具封装化,利用 LLM 智能规划调度。经 Earth - Bench 评估,其在多方面表现出色,未来发展前景广阔。
田渊栋被Meta卸磨杀驴,但全网疯狂发offer!OpenAI冲来抢人了
Meta裁员风暴扩散,FAIR研究科学家田渊栋等被裁。田渊栋入职十年多,成果亮眼,却在协助处理Llama 4相关事务后被裁。此外,不少刚入职的博士也遭殃。同时,Meta还用AI取代人工审核。
墙体的AI革命!智能超表面如何让建筑「听懂」6G信号?
在5G基站功耗高、室内信号衰减成瓶颈的当下,文章探讨6G如何借智能超表面和建筑无线友好性优化室内流量。还分析建筑设计对信号的影响,以及人类移动行为给超表面嵌入建筑信道带来的挑战。
大模型追逐星辰大海,GPT和Gemini国际天文奥赛夺金
新论文以国际天文学和天体物理学奥林匹克竞赛 (IOAA) 为基准测试,证明 GPT - 5 和 Gemini 2.5 Pro 能在天文奥赛获金牌。研究还分析不同模型表现、与人类成绩对比及错误类型,强调需全面评估模型科研潜力。
ChatGPT新功能Pulse,GPT-5主动给你推消息,大家玩得停不下来
本周五凌晨,OpenAI 向 Pro 订阅用户开放 ChatGPT 新功能「Pulse」预览版。它基于智能体,会根据用户信息提供个性化更新,还能异步搜索。用户可管理研究内容、提搜索请求及反馈,未来或推广告、建社交网络。
JCP | 西北工业大学宋家豪、张伟伟等:FENN:特征增强神经网络求解流体力学领域的偏微分方程
物理信息神经网络(PINNs)求解偏微分方程收敛慢,尤其是流体力学复杂非线性问题。该研究提出特征增强神经网络(FENN),在PINNs输入引入几何和物理特征,提升收敛速度,经正、反及参数化问题验证其有效性。
The Batch: 883 | 美国两个州禁止人工智能驱动的心理健康治疗
美国伊利诺伊州成继内华达州后,第二个禁止用人工智能进行心理治疗的州。该法案限制聊天机器人独立治疗及其他AI使用方式,旨在保护患者和人类治疗师,但也引发对全面禁止利弊的讨论。
刚刚,美团开源 SOTA 推理模型 LongCat-Flash-Thinking,性能逼近 GPT5-Thinking
美团宣布开源高效推理模型 LongCat-Flash-Thinking,性能逼近 GPT5-Thinking,是国内首个结合多种推理能力的大语言模型。它采用新方法提升性能,已在多平台开源,API 平台免费开放,还兼容主流 API 格式。