「多场景支持」共找到 6031 篇相关文章
视频生成1.3B碾压14B、图像生成直逼GPT-4o!港科&快手开源测试时扩展新范式
香港科技大学联合快手可灵团队推出 EvoSearch 方法,支持图像和视频生成。该方法无需训练和梯度更新,能提升模型生成质量,展现了 test - time scaling 补充 training - time scaling 的潜力,目前论文和代码已开源。
多模态模型挑战北京杭州地铁图!o3成绩显著,但跟人类有差距
近年来,多模态大模型在多种场景取得进展,但能否‘看懂图’存疑。西湖大学等团队提出评测基准ReasonMap,评估模型在地铁图理解中的能力,发现主流模型有瓶颈,闭源模型虽优但仍逊于人类。
终于来了!ChatGPT更新:新增录音功能,深度研究也可以访问文档和应用程序了
OpenAI对ChatGPT进行更新,在深度研究功能中增加连接器,可连接企业和个人数据源,进行更深入搜索分析;新增录音模式,支持自动整理重点内容等。还调整定价策略,让现有部分用户能访问新功能。
中国半导体显示产业之父,将带出一个超级IPO
投资界消息,奕斯伟计算向港交所递交招股书,有望成“RISC-V第一股”。其掌门人为王东升,曾带领京东方走向全球霸主地位。奕斯伟计算聚焦RISC - V架构,获多轮融资,王东升还投资半导体产业链多企业。
10步优化超越强化学习,仅需1条未标注数据!后训练强势破局
无监督的熵最小化(EM)方法仅需一条未标注数据和约10步优化,就能显著提升大模型在推理任务上的表现,甚至超越依赖大量数据和复杂奖励机制的强化学习(RL)。EM为大模型后训练提供了更高效简洁的新思路。
重磅开源!首个全异步强化学习训练系统来了,SOTA推理大模型RL训练提速2.77倍
清华大学和蚂蚁技术研究院联合团队开源全异步强化学习训练系统 AReaL-boba²,坚持“全面开源、极速训练、深度可定制”理念,实现异步 RL 训练,训练速度最高提升 2.77 倍,支持多轮智能体强化学习训练。
GPT-5七月上线?内部爆料+奥特曼疯狂暗示,自曝前方时刻「令人恐惧」
近日,多方消息显示OpenAI可能7月发布GPT - 5,奥特曼也确认o3 pro快来了。人们对GPT - 5期待颇高,猜测其能力有提升也有局限。奥特曼访谈透露AI会带来多方面变化,应服务个人意志。
“设计师的 Cursor”!拖拖拽拽就能做前端,AI 实时生成代码,代码设计双向同步!
Onlook是号称‘设计师的Cursor’的开源工具,可让用户在浏览器可视化构建前端界面,通过AI驱动双向绑定实现设计与代码实时同步,还具备多项核心功能,适用于多种场景,解决设计与开发痛点。
无需人工标注!AI自生成训练数据,靠「演绎-归纳-溯因」解锁推理能力
新加坡国立大学等机构研究者提出元能力对齐训练框架,模仿人类推理心理学原理,将演绎、归纳与溯因能力融入模型训练。实验显示,该方法提升模型在多任务上的性能,且有跨领域可扩展性。
芯片竞争已经是一场华人内战
当下“全球芯片五巨头”皆由华人掌管,且全球前十大IC设计企业有8家与华人相关,“华人内战”格局明显。随着华人和中国企业在芯片领域积累,专业人才优势向AI产业蔓延。但各企业华人领袖会为自身利益做选择,“华人内战”或持续。