「双模式策略优化」共找到 2002 篇相关文章
Token烧不起了?比肩Claude Opus 4.6免费模型来了,还将开源
昆仑万维旗下天工AI发布SkyClaw - v1.0,为Agent场景深度优化,免费试用后将开源,价格低。性能超同级别开源对手,逼近闭源巨头。训练围绕环境构建、数据合成、强化学习展开,适合长链路Agent工作流。
国产新模王Qwen3.7-Max,海外开发者已经沸腾了
阿里通义千问团队发布的 Qwen3.7-Max,或为面向 Agent 时代的旗舰模型。它能自主跑 35 小时、完成 1158 次工具调用,内核优化不掉线,多项评测领先,应用场景丰富,已上线且兼容主流框架。
ICML 2026 | 西湖大学提出 PiEvo:基于原理进化的科学发现智能体框架
西湖大学研究团队提出PiEvo框架,将科学发现重点从“搜索假设”转变为“进化科学原理”,通过不确定性最小化实现原理空间自主扩展。该框架构建双循环优化机制,实验结果显示其核心指标超越SOTA,收敛速度大幅提升。
刚刚,Thinking Machines出手!首款交互模型来了,翁荔出镜实测
Thinking Machines Lab推出首个大模型TML - Interaction - Small,打破传统人机交互模式,实现全自然交互。它训练范式独特,采用双模型架构等设计,评测表现超GPT - Realtime 2.0等模型,后续还会推出更大尺寸模型。
首个时空时序推理框架:让大模型真正读懂时空数据 | ACL'26
STReasoner是首个结合时间序列、空间结构和自然语言的推理模型,能识别异常源、追踪影响路径。研究团队构建数据生成框架和评测基准,采用三阶段训练策略,模型在多任务表现优,成本低且泛化能力强。
97年金融男带8只「电商龙虾」全球开店!2个月后同行慌了
阿里版「电商龙虾」Accio Work打通国际站,一个工作台可全包选品、发品等七个岗位的活。它结合多维度数据助力选品,还能进行广告诊断、店铺运营等,在不同商家案例中成效显著。
CVPR 2026 | 20步也能稳住画质,这个扩散加速方法不一样
扩散模型推理效率是落地应用的核心制约因素,阿里安全 AGI 实验室 - 御风大模型团队联合浙江大学提出全新扩散加速方法 TC - Padé,在低步数设置下能兼顾生成质量与推理效率,已被 CVPR 2026 录用。
首形科技获得新一轮数亿元A1轮融资,人脸机器人首登《科学·机器人学》封面
首形科技完成数亿元A1轮融资,资金用于系统迭代、部件优化及市场拓展。其创始人胡宇航在仿生情感机器人研究成果丰硕,人脸机器人登《科学·机器人学》封面,突破规则驱动局限,推动AI走向实体化。
企业AI智能体大排雷:138场顶级分享抖出的落地实情
AI智能体重塑软件工程,研究团队分析138场演讲发现搭建时精力多花在工程集成和接口对接。文章结合推理模型与人工校验,介绍企业引入智能体的架构策略、演进历程、应用差异及技术底座等内容。
Anthropic冲塔ASI自进化,要做全球操作系统!Claude OS一刀砍向6.4万亿帝国
Anthropic野心勃勃,开启ASI自进化,目标打造全宇宙最强AI操作系统Claude OS,欲抢夺苹果微软6.4万亿市值。Claude可控制电脑,多项功能上新,还推出自动模式,且营收增长快、客户结构优化,离ASI越来越近。