「视频学习」共找到 2302 篇相关文章
我们就这样在一起搞了两年
作者2024年离开特赛发后创业,用积蓄和炒股所得作为本钱。项目避开大语言模型和视频生成,选教育领域做考研调剂志愿填报,用agent完成工作。产品销售不错,作者虽有心理波动但坚持,未来想尝试新领域。
挤干大模型高分「水分」!最强模型仅49分,南大傅朝友发布Video-MME-v2
南京大学傅朝友团队在 Google Gemini 评测团队邀约下推出视频理解新基准 Video-MME-v2。它有创新的分层能力体系与组级非线性评分,揭示模型与人类的巨大鸿沟、传统 Acc 指标虚高、“Thinking”并非总是增益等现象。
林俊旸离职后首度发声:万字复盘,大模型下一站「智能体式思考」
前阿里千问负责人林俊旸离职后发文,复盘大模型行业演进,指出 AI 大模型未来主线是智能体式思考。文中分析推理模型崛起的启示,探讨思考与指令融合难题,还阐述智能体式思维含义、强化学习基础设施挑战等。
推荐系统进入「双动力」时代!首篇LLM-RL协同推荐综述深度解析
强化学习是推荐系统主流建模范式,但传统 RL 推荐系统有诸多瓶颈。大语言模型崛起带来新机遇,LLM 与 RL 结合开启新范式。研究团队发布首篇相关综述,提出五大协同范式,总结评估体系,分析挑战与方向。
刚刚,马斯克开源基于 Grok 的 X 推荐算法!专家:ROI 过低,其它平台不一定跟
马斯克时隔近三年再次开源X推荐算法,该算法基于Grok,采用端到端学习预测用户兴趣。不过有争议认为这或是因现实压力。专家称其ROI低,其他平台不一定跟进,且此次开源对学术研究价值不大。
通往通用人工智能的关键一步?DeepMind放大招,3D世界最强AI智能体SIMA 2
Google DeepMind发布SIMA 2,这是能在虚拟3D世界自主游戏、推理和学习的通用AI智能体。它集成Gemini模型,从指令跟随到主动认知跃进,泛化性能提升,还具备自我提升能力,为AI和机器人技术发展提供新路径。
YOLO12改进引入DINOv3少样本目标检测精度飙升,分享训练自定义数据集代码
Meta 人工智能研究院的 DINOv3 是基于自监督学习的视觉大模型,解决诸多问题且无需微调,在多任务表现出色。将其引入 YOLO12 后,在不同规模数据集上检测性能显著提升,还分享训练自定义数据集代码。
2万开源项目已用上,OpenAI下了盘大棋,Cursor,Codex智能体纷纷支持
据彭博社消息,DeepSeek计划年底发布可自主执行多步任务、自我学习进化的AI Agent。OpenAI开源的AGENTS.md已获5k星,为编码智能体提供使用说明,还给出示例和使用指南,相关智能体已用于2万开源项目。
00后8亿美金「掀桌」!硅谷AI将书写影视新传奇,终结制片旧时代
00后华人女CEO Cecilia Shen带队转型Cybever为全球首家AI原生影视工作室Utopai Studios,首年获1.1亿美元收入。其技术从3D虚拟环境生成发展到完整视频制作,还推出两部大作,或改变影视行业格局。
CEO们的AI焦虑:一张黑白漫画在硅谷疯传
一张CEO喊着‘要AI’的黑白漫画在硅谷疯传。风投出身的Trace Cohen指出高管与基层对AI转型认知有差距,中层被董事会和技术团队拉扯,危险循环正在形成,真正革命或要从高管学习开始。