「代码生成代理」共找到 3671 篇相关文章
统一框架下的具身多模态推理:自变量机器人让AI放下海德格尔的锤子
当前先进机器人无法像人类自如用工具,现有多模态系统有局限。自变量机器人提出端到端统一架构,以统一表示学习和多任务多模态生成解锁具身多模态推理能力,实现范式转换。
本地无限画布,把AI创作玩出了新高度!
传统AI生图工具使用有局限,缺乏自由组织的畅快感。Infinite - Canvas是本地无限画布工具,支持多种生成后端,有普通和智能两种画布模式,具空间自由、覆盖不同用户等优势,还提供上手教程。
只演示一次,机器人就会干活了?北大&BeingBeyond联合团队用“分层小脑+仿真分身”让G1零样本上岗
北大与BeingBeyond团队提出DemoHLM框架,仅需1次仿真演示就能生成海量训练数据,解决人形机器人移动操作数据效率低、任务泛化差、Sim-to-Real迁移难的问题,在仿真和真实机器人上验证效果良好。
Figma 如何使用 AI 来支持而不是取代设计师
Figma 在设计平台集成 AI,有自动命名层等功能,能将文本提示等转换为生产就绪代码。其 AI 功能基于早期基础设施,关键在于 Dev Mode 和 MCP 服务器,确保设计师掌控输出,降低制作软件障碍。
又一安全圈爆火的开源项目,已经1.66万Star!
现在大家爱用代码AI客户端干活,但碰到安全和逆向任务时,AI易懵圈,因工具散落、经验没沉淀。开源项目`reverse-skill`可给AI装“安全研究导航仪”,支持多种AI编码客户端,有诸多功能特性。
这个春节P图不求人!小红书开源图像编辑新SOTA
今日小红书基础模型FireRed - Image - Edit亮相,在复杂编辑指令、风格化转换等核心指标表现强,在多项权威测试达SOTA。该项目代码等已开源,模型权重将开源。团队还推出RedEdit Bench评测方案。
14.7M参数,小目标AP达到13.9%!FSDETR用频空融合重新定义目标检测
传统小目标检测问题多,2026年4月FSDETR论文提出频空融合法,用14.7M参数获13.9% APS成绩。它有SHAB、DA - AIFI、FSFPN三个核心模块,还给出训练、推理及导出ONNX部署代码。
732M模型超越7B!机器人操控新范式:从视频中「悟」物理
机器人操控有「数据困境」,传统方法需大量人工标注动作演示数据。中山大学王广润教授团队从视频生成模型「借」物理直觉,提出PAR和PhysGen,与英伟达DreamDojo核心思路一致,验证了新的技术路线。
语音“PS”来了!蚂蚁又放大招,ASR+TTS+编辑的全能语音模型开源了!
在大模型浪潮下,语音领域迎来“整合与统一”趋势。阿里蚂蚁团队推出端到端统一语音模型Ming - UniAudio,能在一个框架下完成识别、生成、编辑等任务,语音编辑能力创新,开发者上手简单。
Grok 4作战图刷爆全网,80%华人横扫硅谷!清华上交校友领衔,95后站C位
Grok 4一夜爆火硅谷,一张内部作战图显示其幕后团队华人学者占比达80%,包括Jimmy Ba、吴怀宇等。独立评测中Grok 4成绩优异,但也有人质疑其代码基准结果有过拟合嫌疑。