工作流转变」共找到 1456 篇相关文章

算法论文8

Light-X来了!全球首个「镜头×光照」双控4D视频生成框架,单目视频秒电影级

新加坡南洋理工大学等科研机构联合推出Light - X,全球首个「镜头×光照」双控4D视频生成框架。它解耦相机与光照,在扩散模型中融合,还构建Light - Syn数据管线,实验显示其效果显著优于现有方法。

机器之心
新闻资讯7

公司用了Agent,4000个员工丢了工作!CEO 大刀砍研发:让人和AI协作,各干一半的活儿

CRM软件巨头Salesforce首席执行官Marc Benioff透露,因采用AI Agent裁掉4000人。公司战略转向聚焦Agent业务,还调整人力结构,人和AI各干一半活儿,Marc认为AI影响因行业、地区而异。

InfoQ
算法论文8

工作引来马斯克回复,让Gork破防:CoT是真正的推理,还是训练数据的统计插值?

大型语言模型(LLMs)的思维链(CoT)推理能力被视为突破性进展,但论文揭示CoT可能只是数据分布内的模式匹配幻象,通过实验证明其在分布偏移时表现急剧退化,挑战主流认知。

深度学习自然语言处理
新闻资讯8

对话谷歌前 CEO Eric Schmidt:数字超智能将在十年内到来,AI 将创造更多更高薪的工作

谷歌前 CEO Eric Schmidt 做客播客,探讨 AI 未来。他认为 AI 被严重低估,数字超智能十年内或到来,瓶颈是电力。还谈及 AI 对就业、商业、教育等方面的影响,以及潜在风险和应对建议。

AI科技大本营
算法论文8

无需NeRF/高斯点后处理,视频秒游戏模型成现实!新方法平均每帧仅需60秒 | ICCV 2025

KAUST团队提出全新方法V2M4,能从单目视频直接生成高质量、显式的4D网格动画资源。该方法构建多阶段流程,涵盖相机轨迹恢复等关键步骤,平均每帧约60秒,比现有方法显著提速,论文已被ICCV 2025接收。

量子位
开源动态8

还在花钱转语音?10,000+ star 开源「ebook2audiobook」白嫖1107种语言!免费文字秒多语言音频!

`ebook2audiobook` 是由 Drew Thomasson 主导、13k+ Stars 的开源工具,能将电子书无缝转换为有声书,支持 1107+ 语言,有章节拆分、多 TTS 引擎支持等功能,低门槛部署,适合多场景。

小华同学ai
算法论文8

ICML 2025 Oral工作再升级!上海AI Lab联合复旦、港中文推出支持更长视频理解的最佳工具VideoRoPE++

上海AI Lab联合复旦、港中文推出支持更长视频理解的工具VideoRoPE++。它确定了将RoPE应用于视频的关键特性,构建评测基准V - RULER,提出外推方案YaRN - V,在多任务中优于先前RoPE体。

机器之心
开源动态8

登顶全球权威榜单!浙大创业团队百卡打造开源实时世界模型,视频秒可交互4D世界

全球科技界正豪赌「世界模型」,但主流模型多停留在「视觉生成」。中国影溯公司发布并开源世界模型 InSpatio - World,综合性能优异,以小博大登顶权威榜单,降低了物理世界数字化门槛,引发行业关注。

机器之心
新闻资讯7

OpenAI深夜甩出GPT-5.1,称更热情,更智能!网友狂吐槽:我不想和它聊天,只想用它工作

OpenAI发布GPT-5.1,包括Instant和Thinking两个版本,称更智能、对话更愉快,还增加“个性/语气”选项。但网友质疑“强化个性”方向,想要高效工具而非“虚拟朋友”。

InfoQ
算法论文8

只需一次指令微调,大模型身全能专家天团,8B模型性能反超全微调基线 | ACL25 Oral

预训练大模型适应专业领域需高昂微调成本,稀疏混合专家架构虽能提升推理效率,但从头训练耗资源。浙大与Thomson Reuters团队提出SIMoE,单阶段微调就能升级大模型,还解决传统方法两大局限,在性能和效率上双突破。

量子位