「有意识的AI」共找到 14074 篇相关文章
奖励是假的,能让Qwen提升25%性能却是真的!
华盛顿大学博士生团队用Qwen模型对虚假奖励进行RLVR,使MATH - 500准确率显著提升约25%。研究发现RLVR不考虑奖励正确性,还分析了虚假奖励有效的原因,提示现有研究要在非Qwen模型验证。
Sora 2刷屏全网:拍《瑞克和莫蒂》、过物理测试,太棒了
OpenAI推出的Sora 2刷屏海外,能完成以往视频生成模型极难实现的任务,在物理准确性、逼真度和可控性上有重大提升。它还能进行二创、模拟电脑操作等。OpenAI发布由Sora 2驱动的社交APP,强调促进创作,保障安全。
Gemini:约束
本文围绕“约束”展开探讨,通过对话形式深入剖析其内涵。指出约束不仅是限制,更是塑造和成全;它存在于多个层面,影响着人、组织和事物的发展。还通过公司和人的具体案例,构建了分析约束的框架。
中国需要什么样的机器人?
当下具身智能火爆,人形机器人虽吸睛但商业化难。工业智能体已落地产线,如思谋科技产品进入全球300家龙头企业流水线。行业存在算法不成熟、发展慢等痛点,工业具身智能有望成下一个热门赛道。
GPT-5.5好到不敢睡觉,奥特曼连夜写下五大宣言!
GPT-5.5代号「Spud」,在多项测试中表现出色,开发者实测反馈良好。奥特曼在GPT-5.5发布且口碑好时,写下AI五大原则,称AI要民主化、赋能等,还暗示政府需考虑新经济模式应对AI影响。
ChatGPT和Claude争了个寂寞!用户重叠仅11%,中国应用霸榜移动端
风投机构a16z发布“迄今最受消费者喜爱的Top100 AI应用”榜单。前50个移动AI应用近半来自中国团队,用户多在海外。ChatGPT领先但挑战者来势汹汹,其与Claude用户重叠仅11%,全球形成三大AI市场。
“iFold”,苹果AI新成果
苹果发布基于流匹配的蛋白质折叠模型SimpleFold,被戏称“iFold”。它用通用Transformer模块搭配流匹配生成范式,3B参数版本追平谷歌AlphaFold2性能,还解决了传统模型算力依赖问题,效率高。
当AI开始设计芯片
英国XMOS芯片设计公司正研发GenAI工具,能用自然语言提示配置Xcore处理器硬件特性。这不仅能重塑芯片设计流程,让不同背景的人参与设计,还推动商业模式从卖硬件转向卖确定性,挖掘芯片“时间价值”。
马斯克说漏嘴了!Claude Opus参数5T,Sonnet 1T
马斯克发帖透露xAI的Colossus 2超算训练模型情况,还回应网友时“手滑”泄露Claude的Sonnet 1T、Opus 5T参数。此外,文章梳理网友对Claude各版本参数的推测,也提到Anthropic未发布模型Claude Mythos。
换题还是第一!DM0.5横扫RoboColiseum四榜
本文报道原力灵机DM0.5在智元机器人发起的RoboColiseum具身模型评测中拿下四个单项第一,这已是该模型连续拿下六套不同类型公开评测的榜首,攻破了传统具身模型换题掉分的痛点,目前已开源落地产业场景。