「清华团队研究」共找到 4813 篇相关文章
拆箱开源版Coze:Agent核心三件套大公开,48小时揽下9K Star
扣子两款子产品扣子开发平台和扣子罗盘近期开源,加上此前开源的开发框架Eino,覆盖了Agent开发全链路。其采用宽松的Apache 2.0开源协议,降低开发门槛,有望带动Agent在更多场景落地。
浙大校友打造AI代码测试神器,零代码零bug,30分钟创建网站
浙大校友打造的智能测试平台TestSprite 2.0,零代码零bug,30分钟创建网站,能让AI写代码准确率从42%跃升至93%,还可自动生成测试报告、调试修复错误,全程无需人工干预。
一键实现PPT演讲自由!「解说音频+视频」同步生成,效果逼近真人
澳大利亚与英国研究人员提出文档到演示视频生成任务,推出PresentAgent系统。它能将长文档转为带语音和同步幻灯片的视频,流程可控且适应多领域。实验显示其生成视频接近人类表现,还设计了双路径评估策略。
氛围编程后,Karpathy又双叒有新「脑洞」!PDF将死,未来99%是AI氛围阅读
Karpathy提出未来研究论文不应是PDF格式,未来99%注意力将来自AI,科研成果应为AI优化。此观点源于生物学家Michael Levin关于为AI写作的讨论,引发众多科技思想者回应。
ICML spotlight | 一种会「进化」的合成数据!无需上传隐私,也能生成高质量垂域数据
大模型发展使数据短缺问题加剧,特殊领域更严重。为此提出合成数据自主进化框架PCEvolve,只需少量标注样本,就能在保护隐私同时进化出数据集,还介绍了其架构、选择器设计及实验结果。
研究者尝试揭示扩散模型创造力的起源
斯坦福大学研究人员 Mason Kamb 与 Surya Ganguli 在论文中提出解释扩散模型创造力的机制,指出其创造力是去噪生成图像时的确定性结果,还识别出关键偏置,搭建 ELS 机模型并验证其准确性。
ICML 2025 Oral工作再升级!上海AI Lab联合复旦、港中文推出支持更长视频理解的最佳工具VideoRoPE++
上海AI Lab联合复旦、港中文推出支持更长视频理解的工具VideoRoPE++。它确定了将RoPE应用于视频的关键特性,构建评测基准V - RULER,提出外推方案YaRN - V,在多任务中优于先前RoPE变体。
谷歌发布本地具身智能模型!全程无联网执行精细操作,从人形机器人到工业机器人全覆盖
Google DeepMind团队发布可本地运行的视觉 - 语言 - 动作模型Gemini Robotics On - Device,它能离线运行,操作能力强,可在多种机器人本体部署,解决网络问题,性能、适应能力出色,还开放了SDK。
AI Agent已过时?OpenAI亮出王牌Deep Research!
浙江大学一篇综述论文《A Comprehensive Survey of Deep Research》系统性梳理了Deep Research赛道。它是一类AI系统,其背后的Agent范式可迁移到各场景,文章介绍了其技术、架构、应用及面临的挑战与未来方向。
刚刚,OpenAI找到控制AI善恶的开关:ChatGPT坏人格在预训练阶段已成型
OpenAI最新论文揭示控制AI“善恶”开关。研究发现训练模型在某领域答错题,会致其在其他领域“学坏”,还找到“毒性人格特征”。同时给出解决办法,能让模型恢复正常。