「数据难题」共找到 3467 篇相关文章
Feed-Forward 3D综述:三维视觉如何「一步到位」
这篇由12所机构联合撰写的综述论文,总结2021 - 2025年间数百项创新工作,建立Feed - Forward 3D方法谱系与时间线,介绍五大技术分支、应用场景、评测指标与结果,还指出未来挑战与方向。
乔纳森下一个iPhone神话,要黄了?OpenAI秘密AI硬件深陷三重困境
奥特曼与乔纳森联手打造终极个人AI助理,计划明年发布。但该项目面临基础设施和软件难题,包括算力与成本、人格设计及隐私问题,未来充满变数。
ChatGPT新功能,抢占你早上第一个打开的App
ChatGPT推出新功能Pulse,无需提问就可自动推送个性化更新。OpenAI应用程序首席执行官认为过去ChatGPT很被动,现在Pulse主动出击。不过网友质疑是广告推荐。目前该功能仅Pro用户可用。
从Transformer到GPT-5,听听OpenAI科学家 Lukasz 的“大模型第一性思考”
2017年《Attention Is All You Need》提出Transformer架构,重塑AI版图。其作者“Transformer八子”中,Lukasz Kaiser加入OpenAI,参与GPT-4、GPT-5等研发。他10月将出席大会分享见解,曾预言多模态等趋势已渐成现实。
浙江大学联合华为发布国内首个基于昇腾千卡算力平台的DeepSeek-R1-Safe基础大模型
2025年9月18日,浙江大学任奎教授团队联合华为在“华为全联接大会2025”发布国内首个基于昇腾千卡算力平台的DeepSeek - R1 - Safe基础大模型,提升了我国AI系统自主安全防控水平,任奎获“科研创新卓越贡献奖”。
手机操控革命!开源手机AI Agent,自然语言操控Android/iOS!
传统移动设备自动化工具难实现自然语言控制和跨应用交互,开源项目Mobile - Use提供解决方案。它由Minitap AI开发,能通过自然语言指令实现设备UI感知自动化,功能丰富,应用场景广。
AI 模特时代到来:字节x清华推出商用级视频换装模型DreamVVT,保真度显著领先SOTA
字节跳动智能创作团队联合清华推出视频换装模型DreamVVT,基于Diffusion Transformer构建,用两阶段设计解决复杂场景痛点,支持多种输入,在保真度和时序稳定性上领先SOTA。
Multi-Agent记忆系统MIRIX:比RAG性能飙升35%,存储减少99.9%
现有AI Agent记忆方案有局限,MIRIX作为模块化多智能体记忆系统应运而生。它由六种记忆类型和多智能体框架组成,支持多种检索功能。在多模态和单模态测试中表现优异,为记忆增强型LLM智能体设新标准。
斯坦福开源复杂推理AI Agent,融合超10种工具
传统AI助手应对复杂任务能力有限,斯坦福开源OctoTools,这一复杂推理AI Agent融合11种工具。它在16项基准测试中准确率高,能应对多领域复杂场景,框架含工具卡片、规划器等构件。
这个AI精准模拟人类行为大脑状态,上Nature了
德国团队开发出人类认知通用计算模型Centaur,登上Nature。它基于Llama 3.1 70B,用5天训练,参数仅Llama的0.15%,能模拟人类在160项实验中的行为,性能超传统模型。