「交互问题」共找到 3687 篇相关文章
Sam Altman:我承认我之前错了,AI 超级系统才是 OpenAI 真正想要的
OpenAI 动作不断,创始人 Sam Altman 在访谈中表示,其目标是构建 AI 超级系统,非「超级 App」。还谈及业务思考,如产品战略、Agent 发展、基建合作,以及 Sora 盈利、版权等问题。
700 美金买“真情”?AI情感类产品爆火背后:卖的不止是陪伴,而是年轻人的孤独
本文讲述林悦依赖AI情感陪伴应用的故事,指出当下AI情感陪伴类产品受欢迎,如字节‘显眼包’、卡西欧Moflin。分析市场大的原因,探讨核心价值、产品设计、商业模式等,也提及行业挑战。
首次实现第一视角视频与人体动作同步生成!新框架攻克视角-动作对齐两大技术壁垒
新加坡国立大学等联合发布EgoTwin框架,首次实现第一视角视频与人体动作联合生成,攻克视角-动作对齐与因果耦合瓶颈。它基于扩散模型,通过三大创新设计解决难题,实验性能超基线。
RLHF与RLVR全都要,陈丹琦团队最新力作将推理能力拓展到通用智能
普林斯顿大学陈丹琦团队发布学术成果,提出基于模型奖励思维的强化学习(RLMT)方法,弥合专门推理与通用对话能力差距,将链式思维优势扩展到更广泛范围,提升整体对话表现。
6.1k星星!这个开源 AI 知识库火了。附教程,简单且实用。
知识管理是刚需,因数据安全问题,本地部署的开源知识库受关注。本文推荐PandaWiki,它是AI驱动的开源知识库搭建系统,安装部署简单,功能丰富,适用于企业和个人。
到底谁是第一,阿里和字节吵了起来
AI行业发展,阿里和字节为谁是AI云第一起争执。源于不同报告定义时间滞后、AI云定义不同。MaaS服务是衡量大模型调用量依据,但难定谁领先,阿里云和火山云将有一场恶仗。
Nano Banana核心团队:图像生成质量几乎到顶了,下一步是让模型读懂用户的intention
这是对Nano Banana核心团队的专访。团队认为图像生成质量提升空间有限,未来关键在模型可表达性和读懂用户意图。还探讨了图像模型发展趋势、应用场景、产品设计、评估方式等,提及与传统工具将长期共存。
AI在实时视频里秒“剪”出你想要的部分!输入文字/图/视频片段,它都能秒懂|ICCV2025
最新混合模态在线视频定位技术OVG - HQ开挂了!它能根据文字、图、视频片段等线索,在实时视频流中精准裁剪出关心的事件,已收录于ICCV2025,破局以往技术“离线”“词穷”缺陷。
腾讯提出SPO,告别Group
腾讯团队提出Single - stream Policy Optimization(SPO),回归单流策略梯度范式,解决组基方法瓶颈。它有多项亮点,如告别组同步、采用自适应价值跟踪等,在实验中提升了模型性能和训练吞吐。
冲上 GitHub 热榜,这个智能问数开源项目火了!
数据使用麻烦,存在“数据鸿沟”。开源项目SQLBot基于LLM和RAG技术,能用大白话查询数据库,将问题转成SQL执行并可视化呈现结果,功能实用,部署简单,降低了数据分析门槛。