「精度与效率」共找到 7448 篇相关文章
LeCun团队开源首个代码世界模型:能生成代码还能自测自修!传统编程模型一夜成古典
Meta FAIR推出全球首个代码世界模型CWM,它能生成代码、理解语义,还‘懂得’代码执行,能模拟运行过程。在多个代码与推理任务表现出色,开源代码、训练细节等,不过目前仅支持Python。
Meta打开AI元认知,让AI不止会解题,还会总结套路了
Meta等机构提出‘元认知重用’机制,让大模型学会反思总结。大模型打造‘行为手册’,与主流RAG系统有本质区别。研究人员设计三种实战用法,虽有局限,但为大模型推理难题提供了解决方案。
Wan2.5+Midjourney V7,阿里夸克这个新AI鲨疯了!价格还砍一大刀
夸克“造点”AI发布,采用Wan2.5+Midjourney V7双强模型联合。它不仅接入Midjourney V7,还率先接入通义万相Wan2.5,开放7天免费体验,且会员价格减半。功能强大,生图、生视频等操作丝滑,移动端还能一句话任意P图。
谷歌发布AP2协议,联手PayPal放大招:AI要自己下单了
2025年9月17日,谷歌推出智能体支付协议AP2并开源,宣布与PayPal战略合作。AP2通过‘授权令牌’解决AI下单信任问题,设计三种场景令牌,还采用角色架构保证安全,谷歌联合超60方搭建生态。
第七届硬核芯生态大会暨颁奖典礼圆满落幕
2025年9月11日,第七届硬核芯生态大会在深圳落幕。大会探讨半导体产业多领域话题,如中国芯自主可控、并购趋势等,还揭晓‘2025硬核芯’评选结果,为优秀企业颁奖,推动中国半导体产业发展。
以「场景」定义算力:AI时代,通用算力不只“通用”
当AI狂欢席卷全球,阿里云和AMD通过‘一芯三用’重新定义AI时代算力选型逻辑,从‘参数崇拜’回归‘业务本质’。联合发布三款基于AMD Zen 5架构‘Turin’处理器的全新ECS实例,精准匹配不同业务场景需求。
Meta最新REFRAG框架引爆RAG圈!KV缓存暴降90%,速度狂飙30×
Meta推出REFRAG框架解决RAG难题。它能在不修改解码器参数下压缩上下文、复用文档向量等。实验显示,它降低KV缓存、加速TTFT,在多任务表现佳,为大模型与知识库结合提供新范式。
通用Agent是伪命题?昆仑万维方汉现场拆解:垂直推理才是胜负手|新智元十年峰会
在新智元十周年峰会上,昆仑万维董事长方汉分享公司转型故事与多模态AGI见解。他认为通用Agent非万能,垂类推理数据是关键,还提出AI商业落地逻辑,展示多款产品成果。
华为发布如何利用RL训练强大的Deep Research Agent综述!
华为技术团队发布综述论文,首次系统性梳理利用强化学习(RL)训练强大的深度研究代理。论文指出传统SFT和DPO方法有局限,RL优势明显,还在数据构建、算法设计等方面给出进展与路线图。
具身VLA后训练:TeleAI提出潜空间引导的VLA跨本体泛化方法
现有VLA基座模型能力不足,跨本体适配存在挑战。中国电信人工智能研究院具身智能团队提出“对齐 - 引导 - 泛化”(ATE)框架,实现从调架构到调分布的范式转移,适配主流VLA模型,减少数据需求。