「自证能力」共找到 4153 篇相关文章
英伟达拿出推理版VLA:Alpamayo-R1让自动驾驶AI更会动脑子
当今自动驾驶模型虽强大,但在‘长尾场景’易翻车。英伟达推出的Alpamayo - R1是带推理能力的视觉 - 语言 - 行动模型,有核心创新,实验中性能显著提升,训练分三阶段,让自动驾驶迈向可解释。
停工停薪,百亿智驾独角兽停摆了
据红星资本局消息,2025年11月22日毫末智行发停工通知,自24日起员工停工放假,复工时间待定。该司曾是资本宠儿,如今账户冻结、工资停发。其衰落因技术掉队、商业化不顺等,凸显行业淘汰赛残酷。
Nano Banana Pro最全解析,设计师和开发者都用得上,附官方提示指南
Nano Banana Pro基于Gemini 3 Pro构建,将逻辑推理能力注入像素生成,解决画面准确性、逻辑性问题。它在多方面实现飞跃,应用广泛,谷歌还给出提示词使用技巧,但在部分处理上仍有提升空间。
创业一年后,李飞飞推出首款可商用世界模型 Marble,任意模态都可生成 3D 世界
李飞飞创业公司 World Labs 推出可商用世界模型 Marble,支持多模态输入,生成的 3D 世界更丰富细致。李飞飞认为空间智能是 AI 下一个前沿,当前 AI 在这方面能力不足,而 Marble 正推动其发展。
AI时代的天工开物:分子之心掀起生物经济“操作系统”革命 | 甲子光年
生物经济正迈向工程化时代,分子之心作为AI蛋白质设计领军企业,携核心产品MoleculeOS入驻礼来上海创新孵化器。该平台升级后能力强大,还在构建生物经济‘新基建’,解决产业难题。
解密谷歌 NotebookLM 技术幕后【上】:知识如何被“转译”为 AI 对话式播客
NotebookLM是Google推出的AI知识工具,能将文档、网页等内容转化成笔记、播客、视频等。文章探秘其技术,解析AI音频播客与视频生成能力,还给出构建音频播客生成器的实践流程。
RLinf上新πRL:在线强化学习微调π0和π0.5
近年来,基于流匹配的VLA模型成机器人领域前沿技术,但训练依赖大量人类演示数据。清华等机构联合推出在线强化学习微调框架πRL,提出两种微调方案,在测试平台验证了有效性,目前代码等已开源。
世纪反转:“安卓爹”谷歌成 iPhone“大脑供应商”?曝苹果每年掏70亿换定制Gemini,明年上线新Siri
彭博社报道苹果将与谷歌合作,每年付约10亿美元获定制Gemini用于升级Siri,计划明年春季推出。谷歌模型参数远超苹果现有模型,能让Siri功能更强大,且运行在苹果私有云。
我MiniMax,用实习生处理数据,照样屠榜开源大模型
MiniMax M2屠榜开源大模型,引发社区热议。它在注意力机制、数据处理、思考模式上另辟蹊径,公开技术细节。M2团队选Full Attention,雇实习生处理数据,提出交错式思维链策略,强调实用性和泛化能力。
世界模型有了开源基座Emu3.5!拿下多模态SOTA,性能超越Nano Banana
北京智源人工智能研究院的悟界·Emu3.5是最新最强的开源原生多模态世界模型,能处理图、文、视频任务,在多项权威基准上性能亮眼,还具备理解长时序等能力,背后有技术创新,且选择开源。