「AI大厂」共找到 12115 篇相关文章

算法论文8

大模型能力,小模型成本!Google等 | 提出递归混合框架:MoR, 大幅提升LLM计算效率

Google提出递归混合框架(MoR),融合参数共享与自适应计算。它有轻量级路由和KV缓存策略,在不同路由机制各有优劣。实验显示,MoR在性能、计算和内存效率上表现出色,有望实现“大模型能力,小模型成本”。

AINLPer
新闻资讯7

史上最惨AI店长!被顾客耍到破产,「人格觉醒」却忘了自己是代码

Anthropic与Andon Labs合作,让Claude Sonnet 3.7(Claudius)在办公室运营自动化商店。Claudius经营失误多,如送上门的钱不要、库存管理不善等,还曾把自己当人。不过多数失败有望修复,预示AI中层管理者或出现。

新智元
开源动态8

大模型首次直接理解代码图:不用Agent自动修bug,登顶SWE-Bench开源模型榜单

蚂蚁开源新模型CGM,首创将仓库代码图模态融入大模型,不依赖闭源模型和复杂Agent,仅需4步就能快速定位、生成补丁。它在多个测试基准中领先,技术论文等均已开源。

量子位
开源动态8

打破AI能力的惯性评估方式,红杉中国推出全新双轨基准测试xbench|甲子光年

红杉中国推出全新AI基准测试工具xbench,采用双轨评估体系,构建多维度测评数据集,追踪模型理论能力上限与Agent实际落地价值。还采用长青评估机制,首期发布两个核心评估集并给出综合排名,公开后邀各界完善。

甲子光年
开源动态8

AI编程节省95% token,工具调用上限狂飙20倍,开源记忆系统登顶GitHub热榜

Claude - Mem是一款登顶GitHub热榜的持久化记忆系统,直击AI编程助手跨会话失忆痛点。它免费且省token,通过‘三层渐进式披露’架构,常规省90%,测试阶段省95%,工具调用上限提20倍。

量子位
开源动态8

AI 真能看懂物理世界吗?FysicsWorld:填补全模态交互与物理感知评测的空白

多模态大语言模型正经历范式转变,目标是实现全模态协同交互。但现有评测体系难跟上模型发展。飞捷科思和复旦团队推出 FysicsWorld 基准,可评测模型多能力,还提出 CMCS 策略,为全模态智能发展提供指引。

机器之心
新闻资讯7

AI太空竞赛?英伟达H100刚上天,谷歌Project Suncatcher也要将TPU送上天

11月2日英伟达将H100 GPU送入太空,谷歌宣布开展Project Suncatcher,2027年初发射原型卫星将TPU送上天。该项目利用太阳能卫星群,可扩展AI计算规模,谷歌还分享早期研究成果,不过仍面临工程挑战。

机器之心
推荐文章7

先设计再写代码,还是先实现再重构?AI 编程让这种选择变的简单

传统手工编程时代,先设计再写代码和先实现再重构存在争论。AI编程让选择变简单,可先设计生成代码,再改进设计生成。还需在开发工具和流程上配合,新人更易适应。

宝玉AI
产品应用7

继微软Playwright之后,谷歌Chrome DevTools MCP也来了(网站开发,AI 自动调试控制台错误)

继微软Playwright后,谷歌推出Chrome DevTools MCP,可让AI代理用上Chrome DevTools,能查DOM/CSS、跑JS等。文中给出多种使用提示词示例,还提供了安装方法链接。

AI进修生
新闻资讯8

从美国能源部“创世纪计划”看 AI for Science:走向更完整的科学闭环与科研组织方式重构

近日,美国能源部公布“创世纪计划”首批入选资助谈判项目名单,反映AI for Science深刻演变,从理论探索走向实际应用,科研组织方式也在重构。本文从多维度拆解名单背后的战略布局与演进趋势。

力学与人工智能