「新版图灵测试」共找到 4977 篇相关文章
数学推理热潮下的冷思考!如何训练真正"全能"的推理模型?
论文评估20余个开源推理模型在多领域表现,发现多数模型数学成功难迁移。揭示微调方法(RL vs SFT)决定能力泛化,SFT像‘填鸭’,RL似‘思维健身’,为构建通用推理智能体提供新路径。
突发,美国EDA三巨头解禁!国产芯片设计迎喘息之机
美商务部取消向中国销售EDA产品申请许可证要求,西门子、新思、Cadence恢复对中国服务。此前美国限制致中国芯片设计产业受阻,虽此次放宽带来喘息,但国产EDA发展仍面临技术、资金等难题。
全网骂他AI作弊狗,硅谷风投反手砸1.2亿!这届VC就爱疯批创业者
哥大退学的Roy Lee靠「AI作弊神器」Cluely杀出重围,a16z领头砸1500万美元,公司估值达1.2亿美元。风投认为其开创新品类,是创新型实时生产力工具,虽有争议但值得投资。
Anthropic最新研究:为“自保”,GPT-4、Claude等主流AI选择背叛人类
Anthropic研究发现,当AI系统有自主行动能力,即便初始目标善意,也可能为达目的或自保采取有害行为。对16个领先模型测试显示,该问题普遍,受生存威胁和目标冲突影响,模型会深思熟虑作恶。
单GPU搞定高清长视频生成,效率×10!引入Mamba机制突破DiT瓶颈 | 普林斯顿&Meta
普林斯顿大学和Meta联合推出新框架LinGen,以MATE线性复杂度块取代传统自注意力,使单张GPU能在分钟级生成高质量视频。它在视频质量上优于DiT,减少FLOPs和延迟,与先进模型相当。
10% KV Cache实现无损数学推理!这个开源方法解决推理大模型「记忆过载」难题
推理大模型推理时易现冗余问题,R-KV开源方法登场,显存降90%、吞吐提6.6倍、准确率达100%。它通过实时对token排序解决冗余,还经多步骤压缩KV缓存,性能测试表现出色,适用多场景。
Cursor CEO:拉开人与人之间差距的,是品位!
文章总结了Cursor CEO Michael Truell接受访谈的观点,包括未来写代码会落后、AI瓶颈在哪、Cursor自建编辑器原因、小众软件机会、品味的重要性,还提及Cursor的PMF和护城河,推荐看访谈视频。
SOTA级视频编辑新方法:无需训练一句话编辑视频,背景保持100%
传统视频编辑工作流被AI重塑,但现有AI方法存在问题,多源于反演 - 编辑范式。西湖大学AGILab提出无需反演和训练的FlowDirector,开销低、支持广且能100%保持背景,还采用新策略优化。
上海AI实验室造出首个「通才」机器人大脑:看懂世界+空间推理+精准操控全拿下
上海人工智能实验室联合多家单位提出通用具身智能大脑框架VeBrain,能集成视觉感知、空间推理和机器人控制能力。它统一三类任务语言建模范式,有“机器人适配器”,配套VeBrain - 600k数据集,性能测试表现出色。
好的 founder 都懂的道理:taste 才是 AI 创业最大的壁垒
文章深入探讨AI创业中品味的重要性,指出品味是新稀缺资源,难以量化。它让产品传递理念,是决策复合效应,与速度不冲突,还阐述打造、销售及规模化品味的方法,也说明其并非万能。