「预训练框架」共找到 3486 篇相关文章
李飞飞一年前究竟说了啥?怎么又火了
AI教母李飞飞一年前访谈再引关注,她指出大语言模型或许并非真正智能,其基于一维语言信号训练,在理解三维物理世界存在局限。相关实验也证实大模型在物理任务表现差,不过也有人提出不同观点。
OpenAI/微软争夺AGI控制权!重组谈判激烈,年底谈不成软银700亿或撤
OpenAI与微软就重组问题谈判胶着,核心在控制权与确定性,如多云是否松口、微软能否获取训练细节、AGI条款去留。这影响微软持股价值和软银投资,年底是关键节点,若重组未完成,软银或撤回100亿美元。
中国科学PMA|西工大张伟伟、索玮、宋家豪、曹文博:PINNs的局限性讨论与微分方程智能求解展望
物理信息神经网络(PINNs)是求解偏微分方程的热点方法,有统一处理正、反问题等优点,但也存在求解精度低、普适性差等局限。文章剖析其失效根源,展望了改进方向,为构建微分方程智能求解框架提供参考。
拳打可灵,脚踢 Veo 3,谁是物理世界的「懂王」?
多模态视频生成大模型是复杂系统工程,多为巨头游戏。MiniMax的Hailuo 02发布,ELO得分超谷歌Veo 3和快手Kling 2.0。它能呈现复杂运动,处理物理关系,提升训练推理效率,成本低,后续还将更新。
LeCun亲自官宣!Meta世界模型V-JEPA 2登场!仅用62小时机器人数据,就能实现零样本控制!
Meta发布V-JEPA 2世界模型及三个新基准测试,Meta首席AI科学家Yann LeCun介绍其不同。V-JEPA 2基于视频训练,用62小时机器人数据就能实现零样本控制,还将探索分层式模型和多模态建模。
LeCun有了新证据!大模型思考与人类思考存在本质差别
Yann LeCun参与的研究用信息论揭示大语言模型与人类在‘理解世界’上的本质差异。研究引入新量化框架,分析主流大模型,发现AI与人类在‘理解’上有三大核心差异,对当前AI发展趋势提出挑战。
一文读懂:国产AI芯片与英伟达的差距有多大?
文章围绕国产AI芯片与英伟达的差距展开。从算力性能、生态壁垒、市场现状、技术瓶颈等方面分析差距,指出国产芯片虽在部分场景缩小差距,但高端训练和生态成熟度仍落后3 - 5年,突围需多领域突破。
大模型狙击黑产:挚文集团社交生态攻防实战全揭秘
挚文集团生态技术负责人李波在AICon大会分享大模型在社交生态落地实践。介绍集团生态问题,提出构建治理框架,还阐述多模态大模型研发方案、细粒度用户画像建设及审核侧应用,最后总结现状并展望未来。
一手实测深夜发布的世界首个设计Agent - Lovart。
博主实测深夜发布的世界首个设计 Agent - Lovart。虽内测版细节粗糙,但大框架已现。它先匹配设计风格,再创建执行计划,还支持二次编辑等,集成多工具可生成视频等,未来或重写设计工作流。
ICML 2025 | 清华、上海AI Lab等提出傅里叶位置编码,多项任务远超RoPE
长文本能力对语言模型重要,但现有模型训练窗长有限,流行的RoPE也有局限。清华、上海AI Lab团队用傅里叶分析解读其不足,提出傅里叶位置编码FoPE,提升长文本泛化能力,实验表现超RoPE。