「ARC - AGI - 2」共找到 2371 篇相关文章
RSS 2025|物理驱动的世界模型PIN-WM:直接从视觉观测估计物理属性,可用于操作策略学习
国防科大、深圳大学、武汉大学团队提出物理驱动的世界模型PIN - WM,能从视觉观测辨识刚体物理属性。还提出PADC提升迁移性能,经实验验证其在非抓握式操作技能Sim2Real迁移中表现出色。
中美 NeoLab 对话:模型和 Agent 如何实现「持续学习」?
在新加坡 AGI Playground 2026 舞台上,AMI Labs 林敏和 Mind Lab Andrew Chen 深度对谈,探讨 Agent 如何将经验转化为能力、持续学习。两人对持续学习给出不同答案,还讨论记忆、学习等基础问题及解决办法。
16个月后Meta杀回开源,小扎力挺蒸馏
Meta发布新开放AI模型Muse Glimmer底层参数,未来几周将开放Muse Spark 1.2模型权重。扎克伯格力挺开源,称要为数十亿人提供免费强大AI,还为模型蒸馏辩护。Meta此举有现实压力,也想创造算力需求。
对话刘靖康:镜头之外的「智能」和「审美」,才是 Camera Agent 的主战场
影石 Insta360 创始人刘靖康在 AGI Playground 2026 上提出未来影像设备“前轻后重”趋势。他介绍了 Cameraman 愿景,涵盖 Imaging、AI、Robotics 三技术方向,还提到云端 AI 剪辑服务情况及对行业多方面的见解。
对话景鲲:AI 产品的 All in One,是上下文的 All in One
Genspark 创始人景鲲在 AGI 舞台分享发展路径,其产品从 AI 搜索转型,现推出全功能 AI 办公套件。景鲲判断,未来大模型竞争激烈会商品化,AI 公司壁垒在于捕获用户工作上下文,实现「All in One」AI 工作空间。
Genspark 发布 GenOffice:AI 时代的 Office,免费、开源,抢占办公人群的第一工作入口
8月3日,Genspark创始人景鲲在AGI Playground 2026大会发布GenOffice,这是面向Windows和Mac的本地Office客户端,免费、开源、无广告,将AI引入高频办公场景。GenOffice Alpha版已发布,后续会和用户、AI Agent共建迭代。
Gemini 3.5来了!今夜,谷歌亲手淘汰谷歌
谷歌I/O 2026大会火力全开,发布Gemini Omni、3.5 Flash、Spark等新品。Omni可接收任意输入生成视频,3.5 Flash性能强大,Spark是7×24h云端个人AI特工。谷歌多项能力同时到位,撕开了ASI入口。
首个语音智能体端到端测评出炉:Grok登顶,真实场景通过率仅一半
Artificial Analysis推出业内首个语音转语音智能体端到端性能基准τ - Voice,测试真实客服场景能力。结果显示最强S2S模型成功率刚过一半,Grok Voice Think Fast 1.0夺冠,但也面临诸多质疑。
刚刚,Thinking Machines出手!首款交互模型来了,翁荔出镜实测
Thinking Machines Lab推出首个大模型TML - Interaction - Small,打破传统人机交互模式,实现全自然交互。它训练范式独特,采用双模型架构等设计,评测表现超GPT - Realtime 2.0等模型,后续还会推出更大尺寸模型。
杨植麟当主持人的大模型圆桌:张鹏罗福莉夏立雪都放开说了
中关村论坛上,杨植麟、罗福莉、张鹏、夏立雪、黄超齐聚,共论agent的下一代演进。各位大咖观点硬核,如罗福莉认为中国大模型团队优势在‘算力受限下的最优解能力’,张鹏解释智谱新模型涨价原因等。