「开源应用」共找到 4793 篇相关文章
西湖大学打造了一个AI科学家,突破人类SOTA,还能自己发论文
西湖大学文本智能实验室推出能自主探索的AI科学家DeepScientist,两周完成人类三年科研量。它在三个前沿AI任务刷新SOTA纪录,还能写论文。文中介绍其科研历史、工作方式、成果及面临的伦理问题。
Figure 03重磅发布!指尖能感知回形针重量,年产1.2万台,这次要让人形机器人走进千家万户
Figure AI公司发布第三代人形机器人Figure 03,专为Helix、家庭和大规模应用设计。它有全新传感与手部系统,能感知回形针重量,还做了安全、易用设计,实现低成本量产,适用于家庭和商业场景。
你敢信?GPT-5的电脑操作水平只比人类低2%了
Agent S3刷新了计算机使用智能体(CUA)在「OSWorld」基准测试的记录,性能达69.9%,接近人类水平。它引入bBoN实现并行扩展,还精简框架、引入原生代码智能体,已开源并发布论文。
超10万亿Tokens的高质量数据集是怎么炼成的?专访中国电信天翼AI阮宜龙
中国电信天翼AI打造超10万亿Tokens高质量数据集,依托星辰MaaS平台构建“数据—模型—服务”闭环。其与研究院推进技术研发并落地产品,建“三全”星辰大模型体系,还在多行业展现应用价值。
RAG性能优化:基于RAGFlow自定义解析工具实现文本结构化(含源码教学)
文章围绕RAG性能优化展开,指出RAGFlow框架中DeepDoc解析算法不足,介绍开源与商业化解析工具优劣势及API调用和本地部署特点,推荐TextIn xParse,给出RAGFlow+TextIn知识库构建方法,还探讨了RAG优化方案。
不止剪辑!剪映的未来是一站式AI视频平台
剪映产品负责人宣布,其野心是成为一站式AI成片的创意伙伴。今年对AI文字成片功能系统性升级,整合豆包、DeepSeek模型,新增多种功能,还推出剪小映应用,要打造一站式AI视频编辑平台。
Nvidia GPU深度解析
文章深度解析Nvidia的B30A(传闻)、HGX H20、H100、B200和B300(Ultra)五款GPU,从架构、性能、内存、封装工艺和应用场景等方面对比差异,助读者选合适GPU。
那个最可能带领人类达成AGI的男人,更新了终极路线图:世界模型+人形机器人,再造下一个AlphaFold
Google DeepMind的Demis Hassabis在All - In Summit访谈分享观点,认为世界模型Genie 3是AGI必经之路,由其引导的人形机器人是关键形态。他还谈及Google DeepMind战略定位、AI在多领域应用及迈向AGI挑战等。
让AI学会潜意识推理,Sapient发布类脑模型HRM
新加坡初创公司Sapient Intelligence发布仅2700万参数的分层推理模型HRM,在多项高难度推理任务上超越大模型。它绕过大模型推理困境,借鉴大脑机制,训练效率高,开源后GitHub星标突破10.3k。
快手发布Keye-VL-1.5,同量级SoTA,让模型真正看懂视频!
近年来,多模态大语言模型兴起,但视频理解仍是难题。快手Keye团队推出Keye-VL-1.5,通过Slow-Fast编码策略、渐进式四阶段预训练和全面后训练流程等创新,实现视频理解突破,综合性能领先。