「代码类智能体」共找到 5001 篇相关文章
从高考到实战,豆包大模型交卷了
火山引擎原动力大会 Force 2025 发布豆包大模型 1.6 等多项新产品。豆包 1.6 性能提升,在多方面表现出色;Seedance 1.0 Pro 视频生成能力强。大会强调‘AI 云原生’,还推出多个套件和技术进展。
彻底说清 Human-in-the-Loop【下】:分布式环境下的挑战与应对
本文继续探讨如何将HITL Agent扩展到分布式环境,介绍分布式环境下的挑战与应对、实现分布式的HITL Agent、实现客户端的故障恢复及服务端的故障恢复建议,还给出演示代码参考。
360开源高质量图文对齐数据集!收纳1200万张图像+1000万组细粒度负样本,让模型告别“图文不符”
360人工智能研究团队的冷大炜博士团队开源FineHARD高质量图文对齐数据集,包含1200万张图像、4000万个边界框及对应描述、1000万组细粒度难负样本,能提升模型图文对齐能力,还介绍了构建方法、分析及应用前景。
OpenAI未公开的o3「用图思考」技术,被小红书、西安交大尝试实现了
OpenAI推出的o3推理模型打破传统文字思维链边界,实现图像融入推理过程。小红书与西安交大联合构建多模态深度思考模型DeepEyes,尝试实现类似能力,还开源技术细节,在多任务中表现出色。
字节扣子空间上新一键转播客功能,现在我们真成同事了|甲子光年
5月27日,字节跳动旗下AI协同办公平台扣子空间新增播客功能。其播客音频生成功能让AI从‘说什么’跨越到‘怎么说’,适用于多场景。扣子空间还具备跨模态协作等能力,引入MCP协议,免费开放核心功能。
SIGGRAPH 2025 | CLR-Wire:曲线框可生成?可交互?深大VCC带你见证魔法
深圳大学黄惠团队推出 CLR - Wire 方法,将复杂三维曲线框结构编码到连续潜空间,解决传统难题,能实现高效生成与平滑插值,相关代码已开源,在多领域有应用前景。
一场“直面行业真问题”机器人比赛的万字观赛报告|甲子光年
甲子光年发布ICRA上WBCD赛事观赛报告。该赛聚焦双臂机器人,设生命科学、物流打包、餐桌服务挑战。从实际需求出发,吸引全球团队。各赛展现不同技术亮点,如洛桑联邦理工线控、卡内基梅隆神经 - 符号架构等。
CVPR 25 |全面提升视觉感知鲁棒性,生成模型快速赋能三维检测
香港中文大学(深圳)等单位学者提出 DriveGEN 无训练自动驾驶图像可控生成方法,无需额外训练生成模型,通过两阶段策略扩展训练数据,提升三维检测模型鲁棒性,代码已开源。
Spring 之父:我不是 Java 的“黑粉”,但我也不想再碰它!这门语言拯救了我......
Spring 之父 Rod Johnson 在播客中回忆 Spring 诞生,分享转用 Kotlin 的历程与感受。他认为开源要激发兴奋感,Kotlin 友好、易读,结合 Spring 近乎完美,还对其未来发展提出期望。
如何重现 DeepSeek 推理性能突破
DeepSeek-V3 是热门开源大模型,采用大规模 MoE 架构,优化推理性能是工程难点。阿里团队在 RTP - LLM 完成优化,对齐其推理系统性能,分享关键技术、不足与思考,还提及对 Qwen3 模型的优化策略。