「分镜能力」共找到 3703 篇相关文章
裸辞北大博士带17个Agent,49天造出全球首个AI开放世界!成本仅5000
北大文科博士刘耕带17个Agent,49天、5000元成本、30万行代码造出全球首个AI开放世界Elseland。其玩法、世界、创造都具开放性,刘耕逆风突围,开发效率大幅提升。
一文搞懂 Coding Agent 和 Harness
文章介绍编码智能体和 Agent harnesses 设计,阐述 LLM、推理模型与 Agent 关系,指出 harness 是让 LLM 在特定任务更好用的关键。还详细讲解 Coding harness 六个核心组件,并对比了 OpenClaw。
Anthropic用GAN思路解决AI产出质量问题
Anthropic工程师发现AI会自我欺骗,无法准确评价自己工作。他们借鉴GAN思路,让Generator生成、Evaluator验收。校准Evaluator使其严格,还为前端设计定审美标准,实验证明挑刺搭档能提升AI产出质量。
前荣耀AI实验室主任带队:用“超级大脑”接管农场,24小时不打烊
浙江丘沃智能的AlphaFarm系统开启无人农场新范式,由前荣耀AI实验室主任汤泳等“AI极客”打造。该系统能自主决策执行、实时监控,有四大黑科技,经评估在农业垂直领域领先。
这个春节P图不求人!小红书开源图像编辑新SOTA
今日小红书基础模型FireRed - Image - Edit亮相,在复杂编辑指令、风格化转换等核心指标表现强,在多项权威测试达SOTA。该项目代码等已开源,模型权重将开源。团队还推出RedEdit Bench评测方案。
智能老师的“成人礼”:一只中国独角兽如何在《时代》岸边重新定义“教育奇点”
2025年《时代》周刊“最佳发明”榜单中,松鼠Ai多模态智适应教育大模型作为教育科技领域唯一中国力量入选。其创始人栗浩洋锚定L5级自主教学目标,成果经多地实践验证,还推动教育公平走向全球,牵头制定AI教育标准。
Qwen3-Max-Thinking:会想能干,比强更强
正式推出旗舰推理模型 Qwen3 - Max - Thinking,其在多关键维度显著提升,性能媲美顶尖模型。引入自适应工具调用和测试时扩展技术,现已上线 Qwen Chat,API 也开放,还介绍了使用方法。
为什么 2025 的基模公司都押注 Interleaved Thinking?
本文探讨 2025 年基模公司押注 Interleaved Thinking 的原因。从大模型迭代说起,介绍其在多模型中的体现,阐述该思维链对 Agent 的重要性,还提及 MiniMax 在推动其成行业标准上的诸多努力及带来的影响。
Thinking with Video:一种全新的思考范式
在人工智能领域,‘用文本思考’和‘用图像思考’存在局限。复旦大学等团队提出‘用视频思考’范式,通过视频生成模型统一文本与视觉推理,构建VideoThinkBench基准测试Sora - 2,全面解读这一开创性工作。
你奶奶也能看懂:DeepSeek-OCR的秘密。
本文介绍DeepSeek-OCR,它并非普通OCR工具,而是用“上下文光学压缩”将大量文本信息转为少量视觉Token。其架构含编码器和解码器,压缩效果惊人,重新定义AI“记忆”,或改变AI认知方式。