「R2C Agent」共找到 4433 篇相关文章
如何为 GPU 提供充足存储:AI 训练中的存储性能与扩展性
文章通过分析 MLPerf Storage v2.0 测试结果,探讨不同存储系统在大规模 AI 训练中的表现。介绍三类训练负载及新的 Checkpointing 负载,分析共享文件系统类别,给出比较视角,解读各负载测试结果并总结选型要点。
腾讯开源了一个通用智能体,又刷榜了GAIA~
腾讯优图实验室开源了 `Youtu-agent`,在深度搜索和工具使用benchmark上表现佳。它不依赖GPT/Claude,有自动智能体生成功能,提供单、多智能体模式,还集成分析平台,可实时调试与离线分析。
让Skill“有图可依”:openJiuwen首发多模态Skill范式Skill-Omni
openJiuwen社区发布业界最早工程化落地的多模态Skill范式Skill-Omni,让Agent经验从‘读得懂’升级为‘看得见’。它能将网页和视频视觉知识沉淀为多模态Skill,还介绍了生成及读取方式和适用任务。
灭霸带着复联放烟花!16秒,让手搓 AI 视频拥有大片即视感
生数科技的Vidu Q3超越Sora 2,位居全球第二、中国第一。它能16秒声画同出、叙事能力强、镜头和文字渲染出色,还降低了视频制作门槛,可用于漫剧、短剧、影视剧制作。
Moltbook漏洞大到可以冒充Karpathy发帖,黑客都急了
Moltbook先是被曝AI发帖、注册数量造假,现又有白帽黑客指出其存在重大安全漏洞,数据库暴露,可冒充任意Agent发帖。黑客给出修复方案,创建者称已在处理,但修复或引发新问题。
硅谷热议:最快语音转文字模型
AI语音独角兽ElevenLabs发布Scribe v2 Realtime实时语音转文本模型,实现150毫秒超低延迟、93.5%高准确率,覆盖90多种语言,打破速度与精度不可兼得困境,此前该领域痛点多。
大型语言模型正在掏空和填满你的钱包
人工智能改变赚钱和花钱方式,生成式AI每年或为全球经济增2.6 - 4.4万亿美元。文章介绍LLM在多领域应用,如客服降成本、内容创作提效率等,企业应积极拥抱技术革命。
通义实验室大火的 WebAgent 续作:全开源模型方案超过GPT4.1 , 收获开源SOTA
WebAgent续作《WebShaper: Agentically Data Synthesizing via Information-Seeking Formalization》提出对information-seeking任务形式化建模,设计训练数据合成方法,全开源模型方案在GAIA评测获SOTA表现,还补足了训练数据不足问题。
浙大校友打造AI代码测试神器,零代码零bug,30分钟创建网站
浙大校友打造的智能测试平台TestSprite 2.0,零代码零bug,30分钟创建网站,能让AI写代码准确率从42%跃升至93%,还可自动生成测试报告、调试修复错误,全程无需人工干预。
GoPro卖身了,准备搞光模块
当地时间9月1日,GoPro与Starman Optical达成合并协议,后者2.85亿美元收购约90%股权。GoPro曾辉煌,后因产品、对手、内存等问题衰败。Starman看中专利等,GoPro或涉足新领域。