「图像到视频」共找到 3241 篇相关文章
终于,NotebookLM 和 Gemini 合体了。这是什么神之更新?
NotebookLM社交账号更新,现用户可将其笔记本上传到Gemini App,Pro会员在Gemini Web版能用此功能。二者合体类似Agentic RAG,但目前整合欠佳,未来体验有望提升。
65岁LeCun被卷回巴黎老家!与小扎一刀两断,曝光神秘AI初创
65岁的图灵奖得主Yann LeCun年底将离开Meta创业,其新公司专注高级机器智能,教AI理解物理世界。他批评LLM触及天花板,是AI黑洞,多年来坚持世界模型研究,认为其才是通向真正智能之路。
中心动态重分配哈希,北邮团队提出并开源CRH项目 | AAAI 2026
北京邮电大学等机构联合提出新颖端到端框架 CRH,在训练哈希函数时动态更新哈希中心,提升检索精度和语义一致性。论文被 AAAI 2026 收录,代码已开源。
ICCV25 Highlight|格灵深瞳RICE模型狂刷榜单,让AI「看懂」图片的每个细节
格灵深瞳公司灵感团队自研的视觉模型基座RICE(MVT v1.5)刷榜多项视觉任务,在ICCV25获Highlight荣誉。它延续MVT系列理念,提升图片内部视觉特征差异性,在多任务验证中表现优异。
剪映前AI产品负责人创业多模态Agent,做懂上下文的007乙方,成立半月融资数百万美元
剪映前AI产品负责人廖谦创业,成立极致上下文公司,获数百万美元投资。公司首要打造面向营销场景的多模态Agent,中长期搭建AI信息表达系统,他认为当下是创业好时机,且无传统意义上的护城河。
OpenAI「解决」10道数学难题?哈萨比斯直呼「尴尬」,LeCun辛辣点评
OpenAI研究员宣称GPT - 5「发现」10个悬赏数学难题的解决方法,舆论误以为是解题方法,后发现只是检索到已有文献,引发学界大佬群嘲和对AI夸大宣传的讨论。
CMU&斯坦福提出Reasoning新范式!自己找“窍门”,教会LLM抽象Reasoning
大型语言模型解决复杂推理问题时效率低,论文提出创新方法,让模型利用“推理抽象”,通过RLAD两玩家强化学习框架训练,在多基准测试提升性能,还分析了其作用、局限与未来方向。
每周7亿人都在如何用ChatGPT?OpenAI最全报告来了
OpenAI联合哈佛大学经济学家发表论文《How People Use ChatGPT》,基于内部对话数据,分析ChatGPT从2022年11月上线到2025年7月的使用情况。截至7月,周活超7亿,每周发消息180亿条。
苹果端侧AI两连发!模型体积减半、首字延迟降85倍,iPhone离线秒用
苹果在Hugging Face放出FastVLM与MobileCLIP2两条多模态主线。前者主打「快」,首字延迟压到竞品1/85;后者突出「轻」,体积减半。模型和Demo已开放,开发者可集成开发。
MCU、储存、SiC、传感器、MLCC……国产汽车“硬核芯”全景突围
在国产汽车产业带动下,国产汽车芯片迈入新阶段。传统领域国内企业打入主流供应链,前沿赛道与国际巨头竞技。芯驰、芯擎等企业崭露头角,产业链协同推动供应链自主,芯师爷评选展现行业成果与潜力。