多视图输入」共找到 4263 篇相关文章

产品应用8

TRAE SOLO正式版上线,我用30分钟写了一个想做了半年的网站。

字节的TRAESOLO正式版上线且限时免费。它更新不少,有新的任务列表和SOLO Coder。作者用它做APP logo合集网站,SOLO Builder搭框架,SOLO Coder迭代开发,30分钟完成,功能完整,还介绍了价格。

数字生命卡兹克
新闻资讯8

刚刚,DeepSeek论文登上Nature,更细节披露!

9月17日,梁文锋担任通讯作者的DeepSeek - R1推理模型研究论文登《Nature》封面,它是全球首个经同行评审的主流LLM。不靠人工标注,靠强化学习激发推理能力,学会‘自我反思’,在任务上优于传统模型。

PaperAgent
新闻资讯8

李飞飞首个模态世界模型 Atlas 正式发布:从零开始预训练,几张图就能构建世界

李飞飞创办的 World Labs 发布模态世界模型 Atlas,可原生处理类型数据,有世界生成、重建和模拟等能力。还介绍其研发历程、技术特点,以及 World Labs 收购、融资等情况。

InfoQ
算法论文8

清华天眸芯团队再登Nature系列期刊封面,类脑互补视觉范式重塑AI感知世界的方式

清华天眸芯团队继2024年《Nature》封面后,最新进展又登《Nature Sensors》封面。此次研究实现系统级算法软件生态飞跃,还开源工具链。成果在场景有应用潜力,晰见科技推动其产业化。

机器之心
算法论文8

长程任务飙升98%,斯坦福Skill原生LLM来了

普林斯顿、CMU、斯坦福、牛津等提出Skill-Native大模型,提出Skill Entropy度量技能切换难度,搭建Skill²-Bench评测,还将熵用作训练信号提出Skill-Entropy RL,提升模型准确率,且技能熵可复用。

PaperAgent
产品应用7

Fable 5被网友薅出省钱神招!最高减70%!

网友发现把Fable 5上下文转成图片,让模型通过OCR读取,token输入成本最省70%。方法pxpipe在GitHub获3000+STAR,本质是本地代理,还引出谷歌老论文及DeepSeek - OCR相关技术。

量子位
产品应用8

Claude会「做梦」了,梦里还在卷

Anthropic旗下Claude Managed Agents上线新功能Dreaming,可让AI在工作间隙“睡觉”反思,清理记忆、总结规律、自我升级。此外,还有Outcomes、智能体编排功能进入公开测试,能让AI独立完成复杂工作。

量子位
产品应用8

QClaw V2 升级:微信里直接用的龙虾,真正走入你生活和工作的个人助理

3月8日QClaw发布后文章爆火,近期产品迭代快。QClaw V2引入Multi - Agent机制,可创建角色AI助手并行工作,还能连接主流办公工具,集成龙虾管家保障安全,实测功能强大,优势明显。

特工宇宙
Product Application7

补上OpenClaw最大短板!中国AI独角兽亮出龙虾盒子,打工人放心养虾

OpenClaw热潮下,云端隐私数据保护缺位,端侧算力和全模态脱敏能力不足制约其落地。无问芯穹推出InfiniClaw Box,具备信源融合等能力,采用端云一体架构,实现隐私安全与大模型能力融合。

新智元
算法论文8

AAAI 2026 Oral | 拒绝「一刀切」!AdaMCoT:让大模型学会「看题下菜碟」,动态选择最佳思考语言

语言大模型面临语言选择难题,现有跨语言推理方法存在缺陷。新加坡研究团队推出AdaMCoT框架,通过自适应路由机制动态选语言推理,提升跨语言事实推理准确性与一致性,效果超越传统方法。

机器之心