「视听数据资产化」共找到 2618 篇相关文章
The Batch: 848 | 走进沃尔玛的 AI 应用工厂
全球营收最高的零售商沃尔玛披露其云平台与模型无关的 AI 应用开发平台 Walmart Element 最新细节,介绍其工作原理、典型应用,还提及平台推出目的、原则及意义。
Chrome危!AI浏览器新品大爆发,OpenAI都来抢饭碗
AI时代浏览器成兵家必争之地。英伟达投资的Perplexity推出AI浏览器Comet,OpenAI也将发布。老牌谷歌Chrome难撼动,新势力各有亮点,国内市场争夺也愈发胶着。
Mamba一作预告新架构!长文论述Transformer≠最终解法
Mamba一作将演讲整合成科普长文,探讨SSMs和Transformer模型权衡之术。认为Attention非万能,Transformer是阶段性最优。几天后将发布新架构,能与Transformers兼容,还回顾了两模型特点及结合优势。
飞书MCP不好用?我一天自研了人生教练MCP (v3.0)| 附:我的AI启发
作者因飞书MCP更新与期望不符,花一天自研人生教练MCP组件。介绍了人生教练Agent特点,还给出启动方法,最后分享在MCP实践中发现的AI趋势及实践总结。
数学题干带猫AI就不会了!错误率翻300%,DeepSeek、o1都不能幸免
研究发现,在数学题后加如“猫一生绝大多数时间都在睡觉”这类话术,会让大模型答错概率翻3倍,DeepSeek - R1、OpenAI o1等推理模型中招。研究探索攻击方式,总结出三种攻击模式。
你的衰老速度被科学家拍出来了| Nature子刊
Nature子刊研究推出新指标DunedinPACNI,不看身份证年龄,看“脑年龄”。其数值越高,脑功能衰退风险越高。该指标已开源,或助人们检测身体状况、调整生活方式。
大模型时代,通用视觉模型将何去何从?
过去通用视觉模型(VGM)是研究热点,想实现‘视觉模型大一统’。但大语言模型发展使研究热点转移,视觉‘独立性’被重新定义。清华鲁继文团队综述梳理其进展,探讨现状、挑战与应用潜力。
UofT、UBC、MIT和复旦等联合发布:扩散模型驱动的异常检测与生成全面综述
多伦多大学、麻省理工学院等高校研究者合作完成长文综述,聚焦扩散模型在异常检测与生成领域的应用,梳理图像、视频等异常检测任务进展,提供分类体系,展望未来趋势。
爆款AI视频越来越多,但本质我觉得跟炒股没区别。
作者以AI视频爆款频出为背景,借唐朝张大麻、自身炒股经历等故事,探讨AI视频爆款复制价值、获流量人数及流量后续价值,指出创作应重持续经营,勿盲目跟风。
“甲方快乐模型”诞生,拿下平面设计新SOTA!多条件一键生成,还能独立调整元素 | 复旦&字节
复旦大学和字节跳动团队联合提出CreatiDesign新模型,可实现高精度、多模态、可编辑的AI图形设计生成。它解决了以往方法在处理图形设计时的难题,在多维度评估基准上表现出色,还支持多轮编辑。