「数据架构」共找到 4028 篇相关文章
网民票选AI王者,LMArena一夜变17亿美元独角兽!
LMArena原是校园开源小项目,从2023年起步,如今估值达17亿美元。其Arena模式让网友盲投选AI,Elo评分系统算排名。虽有众包投票易操纵等争议,但已成行业标杆,还将为大厂提供付费评估服务。
直击CES:黄仁勋演讲后4个小时,苏姿丰带着她的“复仇者联盟”上台了|甲子光年
CES 2026上,英伟达CEO黄仁勋演讲后约4小时,AMD董事长苏姿丰登场,展示全栈AI战略。发布Helios架构、新GPU产品及Ryzen AI平台等,走系统工程与长期演进路线,欲抢AI基础设施市场。
个人电脑也能进行智能体RL训练?尤佳轩团队开源OpenTinker
伊利诺伊大学厄巴纳 - 香槟分校尤佳轩团队开源OpenTinker,这是全新‘强化学习即服务’系统。它通过解耦架构和友好API,让开发者在不同算力设备启动智能体训练,解决传统RL框架难题,指明下一代智能体基建方向。
思维链推理是一种脆弱的‘海市蜃楼’,一旦超出训练分布,它便会消失。| 直播预约
思维链提示能提升LLM在多任务上的表现,让人感觉模型在深思熟虑。但研究从数据分布角度剖析,发现思维链推理是脆弱的‘海市蜃楼’,超出训练分布就会消失,强调实现通用推理能力挑战大。
a16z 提出 AI 产品的「水晶鞋效应」:第一批用户反而是最忠诚的
OpenRouter 报告基于 300 多个模型、100 万亿个 token 交互数据,分析 LLM 应用情况。提出「灰姑娘水晶鞋效应」,即 AI 模型首批用户留存率更高,与传统 SaaS 玩法相悖,还通过案例分析其表现及对 AI 创业的影响。
斯坦福人均≈0.1张GPU!学术界算力遭「屠杀」,LeCun急了
学术界GPU荒严重,美国顶尖大学人均GPU少,与大厂差距大。如斯坦福人均0.14张,而微软等大厂数据中心算力惊人。这导致人才流向工业界,学术验证能力弱,但部分高校有改善措施。
视频模型也能推理,Sora2推理能力超过GPT-5
DeepWisdom团队研究发现视频生成模型能推理,在空间类任务上比图文模型更擅长。团队推出VR - Bench基准测试,构建客观评分体系。实验显示视频模型在空间推理有优势,相关代码和数据集已开源。
老外傻眼!明用英文提问,DeepSeek依然坚持中文思考
DeepSeek-V3.2和DeepSeek-V3.2-Speciale推理能力显著提升,海外研究者用英文提问,它却用中文思考。评论有两种观点,相关论文显示中文省token但非最有效,大模型选思考语言并非只看效率。
AI工具已成为史上最大流量入口?
作者白杨SEO看到一张称主流AI工具成史上最大流量入口的图,提出质疑。他指出数据存疑,AI用户使用量远不及搜索,商业化也不成熟,还对比国内外AI搜索优化GEO差异,认为企业要提前布局。
小米开源首个跨域具身基座模型MiMo-Embodied,29个榜单SOTA
小米具身智能团队开源跨域基座模型MiMo - Embodied,它融合自动驾驶与具身智能,在29个榜单创SOTA。该模型基于MiMo - VL架构,采用四阶段训练策略,有效解决领域割裂问题,为通用VLA模型奠定基础。