「多领域推理」共找到 6478 篇相关文章
ICLR 2026 | LongHorizonUI:让 GUI 智能体不再"半途而废"——面向长链路任务的统一鲁棒自动化框架
近年来,基于多模态大语言模型的GUI智能体在自动化操作上虽有进展,但任务步数超10 - 15步时成功率断崖下跌。研究人员提出LongHorizonUI框架,构建LongGUIBench评测基准,推动GUI自动化在复杂场景落地。
刚刚,Gemini攻克「宇宙弦」终极难题!AI科学家最优雅解法震撼物理学
Google Research团队用Gemini Deep Think + 树搜索框架,攻克理论物理领域宇宙弦引力辐射功率谱精确解析解难题。AI探索600条候选路径,找出6种解法,最优雅的格根鲍尔方法让物理学家拍案叫绝。
YC总裁转发、登顶Hacker News:SkillsBench揭开Agent技能扩展的残酷真相
近日论文《SkillsBench: Benchmarking How Well Agent Skills Work Across Diverse Tasks》引发海外AI社区关注。研究聚合47150个Skills,经严格筛选评估,揭示人工构建Skills效果好、AI自生成无效等核心发现,为AI研发指明路径。
对话 Elys 创始人 Tristan:人的灵魂是所有 context 的总和,我们从未被真正连接过
本文是极客公园创始人张鹏与 Elys 创始人 Tristan 的对话。Tristan 认为产品应围绕 context 构建,Elys 结合记忆、推荐等系统,要打造低熵社交世界,还介绍了产品设计、用户导入等方面内容。
创建“中国的ASML”!中芯国际、北方华创等掌舵人联名建议
多位中国集成电路行业领军人物联合撰文,提出在‘十五五’期间通过整合机制,集中力量解决极紫外光刻等关键问题,建议创立‘中国的ASML’,还设定了未来五年产业发展的量化目标。
数据邪修大法好:仅用文本数据就能预训练多模态大模型
多模态大模型研发中,行业认为无图文对就无多模态能力。但ReVision研究表明,预训练阶段昂贵配对关系非必需,利用非配对数据统计信息修正文本表征,能实现跨模态互换,降低成本。
英伟达护城河被AI攻破,字节清华CUDA Agent,让人人能搓CUDA内核
近日,字节跳动Seed团队和清华AIR的CUDA Agent引发轰动。它能编写经优化的CUDA内核,性能超torch.compile等。研究发布CUDA - Agent - Ops - 6K数据集,介绍系统管线设计、训练流程,实验结果佳,但有未对比复杂编译器等局限。
Artificial Analysis 榜单第二,SkyReels-V4 宣告 AI 视频进入「全栈统一」阶段
昆仑天工的 SkyReels-V4 在 Artificial Analysis 文生视频榜单排第二,ELO 评分 1090。它有「运动参考」能力,能覆盖视频创作全工作流,背后靠统一拼接框架和双流 MMDiT 架构,体现 AI 行业「统一」趋势。
第三个软件黄金时代来了!软件工程宗师、70 岁 UML 之父发声:AI 自动化被严重夸大,Dario Amodei 又越界了
软件工程宗师、UML 之父 Grady Booch 在播客分享对计算领域三次‘黄金时代’理解,直言 Anthropic CEO Dario Amodei‘软件工程将 12 个月内自动化’判断错误,强调工具虽变但软件工程难题未消失。
请回答2026:38位中国AI关键人物的Magic Moment和趋势判断|甲子光年
甲子光年与38位中国AI关键人物对话,总结2025年Magic Moment,展望2026年技术趋势。2025年是中国AI关键年,2026年大家不再聚焦大模型,更关注多模态、智能体等‘系统级智能’突破。