「反馈循环」共找到 374 篇相关文章
谷歌Nano Banana 2 来了,图片AGI提前到来?
伴随Gemini 3、GPT 5.1小道消息,谷歌Nano Banana 2提前到来。它采用多步骤生成流程,有自我纠错循环,能替代部分Photoshop功能,在细节、配色等方面比一代提升明显,即将正式上线。
总成本降低30倍,告别昂贵后训练,在线策略蒸馏敲开大模型后训练的未来
明星公司Thinking Machines由前OpenAI首席技术官联合创立,其研究团队提出在线策略蒸馏的LLM后训练方法。该方法结合在线策略训练与蒸馏优势,解决后训练两难困境,成本降30倍,还为持续学习和个性化打开新大门。
实战·Agentic 上下文工程(上):无需微调,让智能体自我学习与进化
在Agent时代,提示工程进化成上下文工程。斯坦福等团队提出Agentic Context Engineering(ACE),让智能体自我学习与进化。文章介绍了上下文工程的必要性、定义、常见策略,以及ACE的概念、原理与架构。
揭秘OpenAI 1.5万亿美元交易内幕:奥特曼核心圈子主导,绕开银行家和律师
OpenAI CEO Sam Altman与内部核心高管圈子主导1.5万亿美元系列交易,绕开银行家和律师。交易呈技术优先、财务后置非传统模式,如与英伟达、AMD等多笔重磅交易,还介绍了绕开外部顾问原因。
OpenAI版抖音要来了!Sora 2加持,只能发AI生成视频
OpenAI正为视频生成模型Sora 2推独立社交应用,形态似TikTok,内容须AI生成,不可上传外部媒体。有独特身份验证功能,已内部测试获积极反馈,将与Meta、Google、TikTok竞争。
Oxlint 1.0 稳定版发布:基于 Rust 的 JavaScript 静态检查器
Oxlint是基于Rust的JavaScript和TypeScript静态检查器,其1.0稳定版发布。它有快速检测、规则覆盖广等特点,性能比ESLint高50 - 100倍,能处理多文件规则,开发者反馈积极。
Genie 3,让幻觉持续成为现实
Google最新发布的Genie 3能从文本生成交互式世界,实现24fps实时交互,分钟级一致性,720p分辨率。它取长补短,有出色记忆能力,物理表现自然,还能让智能体完成任务。不过目前是有限预览,有不足。
3D-R1重塑三维视觉语言推理!让三维交互更智能
近年来,视觉 - 语言模型在2D图像理解有突破,但3D视觉语言模型面对复杂场景不足。为此上海大学团队提出3D - R1模型,它基于新数据集和策略构建,有强多任务三维理解能力,不过也存在进步空间。
EvaLearn:AI下半场的全新评测范式!
OpenAI研究员指出传统基准测试难衡量AI实际效用。复旦大学与字节跳动等团队提出全新评测范式EvaLearn,以连续问题求解为核心,构建问题并设评分标准,对九个前沿大模型研究有诸多发现。
o3-pro通关“推箱子”,人类怀旧小游戏成了大模型新Benchmark
推箱子、俄罗斯方块等经典小游戏成大模型benchmark,o3 - pro挑战这两款游戏表现出色,突破benchmark上限,成绩远超o3。Lmgame含多款游戏,有不同评价方式,且开源可用于模型测试。