「艺术与科技」共找到 7146 篇相关文章
抖音&LV-NUS开源多模态新模,以小博大刷新SOTA,8B推理比肩GPT-4o
抖音SAIL团队与LV - NUS Lab联合推出多模态大模型SAIL - VL2,以中小参数规模在106个数据集实现性能突破。该模型从架构、数据、训练三方面创新,后经全链路优化,在多数据集验证中表现卓越。
打破AI能力的惯性评估方式,红杉中国推出全新双轨基准测试xbench|甲子光年
红杉中国推出全新AI基准测试工具xbench,采用双轨评估体系,构建多维度测评数据集,追踪模型理论能力上限与Agent实际落地价值。还采用长青评估机制,首期发布两个核心评估集并给出综合排名,公开后邀各界完善。
又一家首店落地东城!机器人咖啡师,24小时不打烊→
近日,京东旗下七鲜咖啡首家24小时智能无人咖啡店落地北京银河SOHO。饮品全流程由机器人执行,单杯制作超不过30秒,还能并行制作多杯。它兼顾标准出品与个性体验,也切中现代城市生活痛点。
性能超越李飞飞,他们把10亿高斯点的3D世界装进浏览器
群核科技开源3D高斯浏览器Aholo Viewer,渲染速度和大场景加载性能超Spark2.0,能让任何设备浏览器流畅运行10亿+粒子的超大3D场景。它还带动信息载体范式跃迁,推动AI理解三维世界。
System 3 觉醒:从“工具”到“物种”的根本改变
西湖大学与上海交大新论文提出System 3概念及Sophia框架,将认知心理学概念映射到代码模块,让AI Agent像“生命体”生存。采用前向学习和混合奖励机制,实验显示其能力显著进化,为人工生命指明道路。
直播预约 | 如何缓解LLM-as-a-Judge的潜在偏好?UDA:一种无需人工标注的无监督去偏对齐框架
论文针对不同大模型对同一组大模型回答打分差异大等问题,提出无需人工标注、模型无关、即插即用的UDA框架,以无监督方式动态调整Elo评分,实验表明该方法能降低打分标准差、提升与人类评分相关系数。
豆包手机被曝搭载锤子 SmartisanOS,二手价逼近8000元!罗永浩点赞字节:技术革命谁也挡不住
近日,豆包手机助手发售即被抢空。有博主发现其系统有锤子科技遗留字样。该手机官方价3499元,二手溢价超一倍。罗永浩点赞。不过,它风波不断,官方回应是技术预览版,不面向普通消费者。
2025 社交新方式:当 AI 成为「第二个我」,去实现「真实连接」
作者作为业余AI产品经理,体验Second Me这款AI应用。它能借助AI复刻「AI自我」,基于记忆匹配社交,作者借此完成与他人的深度交流。同时探讨了AI社交风险,认为AI应是社交起点,帮人筛选和破冰。
PixelRefer :让AI从“看大图”走向“看懂每个对象”
多模态大模型多停留在整体场景级理解,现实任务需细粒度、对象级理解。浙江大学等联合提出PixelRefer框架,可实现精细视觉指代与推理,在多项任务表现领先,轻量版性能优,还开源两类数据集。
清华联手快手可灵,撞车谢赛宁团队RAE,用SVG再证明VAE已过时
AI图像生成正告别VAE技术。清华与快手可灵联合提出SVG方案绕开VAE,纽约大学谢赛宁团队也提出RAE模型。SVG用自监督特征构建潜空间,在质量、效率和通用性上超传统,证明统一视觉模型可行。