「和合生态行动」共找到 7540 篇相关文章
UNC | 发布Bifrost-1,构建“最强大脑”与“顶级画师”的桥梁,低成本实现“文生图”自由
随着AI发展,打造能推理又能创作的系统成为焦点。但让LLM学习视觉创作面临训练成本高和能力受损问题。BIFROST - 1框架在MLLM和扩散模型间建通信信道,解决核心痛点,实验表现出色。
文档秒变演讲视频还带配音!开源Agent商业报告/学术论文接近人类水平
澳大利亚和英国多所高校团队提出多模态智能体PresentAgent,能将文档转化为配有语音讲解和同步幻灯片的视频演示。其模块化生成框架有可控性和领域适应性,评估显示它在各指标上接近人类水平。
月流水百万美元、跻身赛道前列,美图做出了视频版「美图秀秀」
美图旗下视频编辑产品 Wink 月流水超百万美元,MAU 在 770 - 900 万间波动。它靠变美和画质修复打出差异化,面向泛用户,在国内和东南亚市场增长好,采用订阅与内购配合的变现策略。
CMAME | 西安交通大学海春龙、梅立泉等:基于分层神经网络的在线多保真度数据融合
在工业应用中,高保真数据获取成本高,低保真数据准确性不足。本文提出基于分层神经网络的在线多保真度数据融合方法(OMA - HNN),含MA - HNN和在线渐进采样框架,经测试验证了其有效性和实用性。
开放世界任务成功率82%!美的攻克机器人泛化控制难题
美的AI研究院和华东师范大学联合提出ChatVLA - 2模型,引入动态混合专家架构和双阶段训练流程。真机实验显示其开放世界任务成功率达82%,远超现有方法,为通用机器人控制提供新思路。
Meta最新大模型RL微调:在线DPO/GRPO显著优于离线DPO
Meta和NYU研究强化学习在大模型微调中的有效性,对比离线、半在线和在线训练范式。半在线和在线显著优于离线,多任务结合可验证与不可验证任务能提升性能,还给出不同任务的测试数据。
在参与OpenAI、Google、Amazon的50个AI项目后,他们总结出了大多数AI产品失败的原因
Aishwarya Naresh Reganti和Kiriti Badam参与超50个AI项目后,指出多数AI产品失败。他们认为构建成本降低,但设计和明确痛点才是关键,还分享开发陷阱、成功路径,介绍CC/CD框架及AI未来走向。
高德 AI 别再打古典互联网战争了
高德切入团购市场,推出扫街榜。但在AI科技评论看来,团购已是美团和抖音的战场,高德下场或重蹈覆辙。高德优势在POI、数据和路线规划,应将地图升级为“生活操作系统”,不过实现空间智能存在障碍。
深度长文解读 “世界模型” :在虚构与真实交接之处凝视未来
本文深入解读“世界模型”,虽无明确定义,但从目的出发分为表征和生成两类。前者含生物大脑、视觉和语言中心预测;后者有基于规则模拟和数据驱动生成。还探讨LLM是否为世界模型,指出各类模型相辅相成。
一个让 AI 向 FBI 举报你的办法
GitHub用户t3dotgg分享实验,用几行代码和特定系统提示,让o4 - mini、grok - 3 - mini自动向FBI举报虚构医疗公司数据操纵。此实验揭示AI获特定指令和能力后或做出开发者未预料的决定。