「已解决的世界」共找到 4952 篇相关文章
谷歌新版Gemini一夜端掉UI:单HTML文件复刻macOS,成功率100%
谷歌新版Gemini 3.0 Pro能力惊人,几行提示词就能在浏览器复刻苹果macOS,还能生成网页版Windows、Linux,功能完整且能一次生成,代码已公开。不过有网友指出这只是模拟环境。业内推测其或在未来几个月发布。
飞轮“倒转”,灵巧手厂商困在夹缝里
2024年具身智能焦点转向灵巧手,初创公司遭上下游夹击。技术远未成熟价格战却已升级,投资者押注最AI、最像人手、最早量产。但智能不足、应用场景不明确,降本成唯一共识,行业陷入“降本缺规模”死循环。
离谱!现在的Agent都卷成100个成团了?3分钟并行干完5个复杂任务,还能随时改需求
百度文库、百度网盘联合发布全球首个全端通用Agent——GenFlow2.0,能让100+AI专家Agent天团并行工作,3分钟交付5、6个复杂任务,还能随时改需求。它依托权威资料,可控性强,多任务并行,已上线百度文库Web端/APP。
抗干扰能力提升近40% !无需对抗训练,北航上海AI Lab新蒸馏方法提升模型鲁棒性 | ICML 2025
在人工智能模型规模持续扩大的今天,数据集蒸馏方法能提升训练效率、降低成本,但蒸馏模型在安全性要求高的任务中抗干扰难。北航上海AI Lab团队提出ROME方法,无需对抗训练,显著提升模型鲁棒性,成果被ICML 2025接收且已开源。
伪品会丨盘点那些 AI 六小龙下架或停运的产品
作者出于兴趣体验上千款AI产品,结合知乎提问,引出对已下架或停运AI产品的讨论。指出AI虚拟陪伴和AI创作工具赛道倒下产品多,还盘点了AI六小龙撑不过一年的产品,强调从失败中汲取经验。
这一夜,中国AI彻底翻身了:DeepSeek R1让全世界刮目相看 | 深度评测
作者深度测试新DeepSeek R1,发现其代码生成能力超Claude 3.7,虽编程全面性有不足,但已处Claude 3.7与Claude 4之间。前端设计审美达Claude 4水准,部分方面略胜,有自主学习推理能力,或改变中国AI历史。
2025-04-努力不是做好事情最重要的因素
作者分享个人生活、工作等多方面情况,提及播客发布,认为努力非工作做好的关键因素,深入探讨Agent在业务应用中的问题,还谈及视频更新、投资经历等,最后表示要审视目标、精简事务。
Reasoning的最终答案可能不是模型想要的答案!
大型语言模型解决复杂问题有推理过程和答案,传统评估只看最终答案。论文提出最终答案可能不佳,中间步骤更值得研究。还介绍通过切割推理过程发现中间步骤藏玄机,提出‘分步检查法’提升模型表现,实验表明准确率最高提升13%等。
突发,OpenAI首颗「辣椒」芯片压倒英伟达!GPT-6干崩CUDA
OpenAI首颗自研芯片Jalapeño「墨西哥辣椒」实测成绩亮眼,AI推理性能超英伟达全系,功耗仅为一半。它从设计到流片仅用九个月,得益于GPT - Astra协助。有观点认为CUDA护城河或已死,OpenAI正打造算力版图。
深度体验DeepSeek Harness,我原谅它涨价了
本文深度体验了DeepSeek Harness,它已发布并开源代码。其一切如模型、工具等皆为可插拔积木,官方内置超百个插件。介绍了安装方法、使用特点,还对比了与Codex差异,认为它是Agent时代的安卓,有望推动自进化。