「高质量输入」共找到 2440 篇相关文章
Sora没做到的,LongVie框架给解决了,超长视频生成SOTA
视频生成近年进步大,但生成超1分钟高质量长视频仍难。上海人工智能实验室等机构提出LongVie框架,解决时序不一致和视觉退化问题,还推出评测基准LongVGenBench,该框架在多项指标达SOTA。
AI"学霸"也解不出高中题?耶鲁、复旦发布MMSciBench,揭示AI理科推理能力短板
耶鲁、复旦等推出MMSciBench评测基准,揭示主流模型复杂科学推理短板。它有高质量数据、多模态多题型测试和精细知识分类体系。测试发现模型图文融合及推理能力弱,英文推理或效果更好。
太空算力排队到2030年,这家初创公司不等了:自己造火箭把数据中心送上天
5月11日,太空基础设施Cowboy Space完成2.75亿美元B轮融资,估值达20亿美元。其创始人Baiju Bhatt计划自造火箭,将上面级改造为在轨数据中心。但造火箭门槛高,轨道数据中心面临经济、延迟等难题。
具身机器人抢着砸钱上春晚,投资人回应了
具身智能机器人打响春晚赞助大战,宇树科技、魔法原子、追觅科技等参与。纪源资本管理合伙人符绩勋认为头部公司需高曝光,能获更多商业机会、政府和资本支持。他还分享了对行业估值、出海等问题看法。
LinearRAG:一种免关系提取的高效 GraphRAG 图构建方法
研究指出 GraphRAG 模型在实际应用中表现常不如朴素 RAG 方法,原因是自动构建的知识图谱质量不佳。为此提出 LinearRAG 框架,有三大核心创新,在四大基准数据集上全面超越现有方法,代码和数据已开源。
RL成本降幅超90%!Meta提出Agent训练新范式DreamGym
传统强化学习(RL)训练LLM Agent面临成本高、任务多样性不足等挑战。Meta团队提出DreamGym框架,以经验合成为核心,通过三大组件协同工作,在多种任务和模型上提升性能,为通用Agent训练开辟新路径。
3B模型性能小钢炮,“AI下半场应该训练+验证两条腿跑步”丨上海AI Lab&澳门大学
上海AI Lab和澳门大学联合发布通用答案验证模型CompassVerifier与评测集VerifierBench,填补Verifier领域循环迭代体系空白。AI下半场评估比训练更重要,当前验证方法有困境,新模型验证精度高且能用于强化学习。
Google 发布 142 页年度DORA 报告:90% 开发者每天花 2 小时使用AI,比去年增长14%
Google发布142页年度DORA报告,显示90%开发者每天花2小时用AI,比去年增14%。开发者对AI代码信任谨慎,看法分化,速度提升比质量改善明显。报告还分析团队类型、采用时间等,指出技术限制和就业现状。
OpenAI不Open!7年功勋老将投奔宿敌,实验室沦为API代工厂
2026开年,OpenAI的「推理之父」Jerry Tworek离职,他入职近七年,是推理技术核心人物。Scaling Laws失效,后训练成主要出路,但深度推理成本高,在强调盈利环境下,Tworek不满研究受限而离开,OpenAI或失去通往AGI的机会。
Scaling时代终结了,Ilya Sutskever刚刚宣布
Ilya Sutskever 在访谈中称「Scaling 时代已终结」,指出当前模型存在能力参差不齐、泛化不足的问题。他认为人类情绪类似价值函数,人类学习效率高。未来 AI 发展将进入研究时代,他还分享了 SSI 战略及对 AI 对齐等问题的看法。