「推理场景」共找到 3754 篇相关文章
首个为具身智能而生的大规模强化学习框架RLinf!清华、北京中关村学院、无问芯穹等重磅开源
人工智能从‘感知’迈向‘行动’,具身智能成焦点。当前强化学习框架对具身智能支持受限,清华等机构联合开源面向具身智能的框架RLinf,提出混合式执行模式,设计灵活可扩展,在多方面表现出色。
教育工作者如何使用AI?Anthropic分析了7.4万份对话后,发现了这些
Anthropic分析7.4万份匿名对话,揭示高校教师用Claude的情况。教师用AI场景多样,如课程开发、学术研究等。使用方式分协作增强与完全委托,AI评分有争议,研究也存在局限。
阿里开源 Vivid-VR!带来逼真连贯的视频修复
阿里开源 Vivid - VR 用于视频修复,基于 T2V 模型结合 ControlNet 保证画面一致性。它引入概念蒸馏训练策略,设计控制特征投影器和双分支 ControlNet 连接器,实验展现出优异表现。
Skywork技术论坛一手分享:Agent与多模态的落地真相|甲子光年
8月19日,昆仑万维发起第一期Skywork全球技术论坛讨论会,众多高校和企业嘉宾围绕Agent与多模态展开交流。探讨了Agent商业化、多模态应用等核心问题,提出诸多判断,指出行业热度高但落地是关键。
DeepSeek 官宣V3.1:迈向 Agent 时代的第一步!
DeepSeek 官宣发布 V3.1,称这是迈向 Agent 时代第一步。其有混合推理模式,Agent 能力全面进化,API 也全面升级,支持 Anthropic API 格式。还继续开源,9 月 5 日起调整价格,社区反响热烈。
突破Claude-4编程上限!自进化Agent框架拿下新SOTA,底模越好性能越高,已开源
中科院、清华等提出SE - Agent自进化框架,突破Claude - 4编程上限。它让智能体系统性修订、重组与精炼思考过程,在SWE - Bench Verified上刷新开源框架SOTA,已开源。
腾讯混元开源游戏AI生成新工具!RTX 4090就能制作3A级动态内容
腾讯开源游戏视频生成框架Hunyuan - GameCraft,基于混元视频生成搭建,操作简单,输入单张场景图、文字描述和动作指令就能生成高清动态游戏视频,解决传统工具瓶颈,性能优于主流模型。
国产LLM又迎来一波开源潮:Qwen、华为盘古、腾讯混元、小米~
本周国产开源LLM集中爆发,Qwen、华为盘古、腾讯混元、小米等接连发布模型。如Qwen3 - 4B性能提升,Qwen - Image文生图能力强;华为开源盘古模型并宣布CANN开源;腾讯混元小尺寸模型特点多且已落地业务。
亿万打工人在用的WPS,未来可能要重塑你的工作流
WAIC上,金山办公发布WPS AI 3.0及原生Office办公智能体WPS灵犀。WPS知识库解决文档管理难题,WPS灵犀功能全面,能深入办公场景,还推动AI办公向Agentic Software演进。
技术狂飙下的 AI Assistant,离真正的 Jarvis 还有几层窗户纸?
随着AI技术进入新阶段,LLM面临新天花板,市场呼唤从「会聊天」迈向「能行动」的下一代AI Assistant。文章从智能规划与调用等维度分析其发展挑战,介绍不同技术路径并分析优劣势。