「测试效率」共找到 2785 篇相关文章
阿里+清华发现80/20法则:LLM只靠20%的token就能学会Reasoning
阿里与清华研究发现,训练大语言模型(LLM)推理时,真正关键的是20%的高熵token,其余80%低熵token几乎无用。仅用20%高熵token做强化学习,效果超全量训练,还提出RLVR训练策略提升效率。
2秒终结AI 3D不可能三角,我们和VAST首席科学家曹炎培聊了聊
速度、质量、管线可用性是AI 3D生成的不可能三角。VAST发布的Tripo P1.0首次在原生三维空间概率生成,2秒输出专业3D资产,效率提升百倍,生成结果可直接用于多场景,突破了这一困境。
ChatGPT的第一块广告位,被谁买走了?OpenAI:别骂,我们这次所有底线都招了
OpenAI宣布将在ChatGPT测试广告,以标注“赞助”链接形式出现在回答底部,不影响回答内容。广告仅对免费版和Go套餐用户展示,OpenAI称广告收入占比将低于总收入一半,还说明了广告原则等情况。
工作场景AI化,一个月花100美元订阅AI工具值吗?
AICon 全球人工智能开发与应用大会 2025 北京站即将召开,InfoQ 直播栏目邀请来也科技胡一川、阿里汤威、美团邹明远、快手王东旭探讨 AI 时代「10x 个体」与「10x 组织」,分享落地路径、效率提升及工具使用经验。
阿里云秘密武器亮相顶会:狂砍82%英伟达含量,213块GPU干了1192块的活
阿里云与北大合作,由CTO周靖人带队的研究提出GPU池化系统Aegaeon,亮相顶会SOSP。它用token级自动扩缩容技术,将GPU使用量从1192个减到213个,提升了资源利用率,还在百炼平台测试成功。
从 Chat 到桌面 Agent:我在一台旧 Windows 上,看见了办公的未来
本文作者作为Mac老用户,为体验昆仑天工研发的Skywork桌面Agent,找来旧Windows电脑测试。该产品定位是接管电脑工作世界,解决办公任务处理和安全隐私问题,还介绍了其功能和使用效果。
告别 AI 土味审美!Kimi K2.5 实测:扔个视频复刻 iOS 级丝滑动效
Kimi 上线 K2.5 模型,前端审美佳,接近 Gemini 3,增强多模态识别,支持视频。测试显示它能按要求生成漂亮网页,还可通过反馈迭代。它对设计师和普通人帮助大,且 Agent 模式任务完成率高。
全靠Claude Code 10天赶工上线,Cowork 删用户11G文件不含糊!核心研发:长时间打磨再发布很难成功
Anthropic发布的Claude Cowork研究预览版问题频出,如删用户文件、窃取文件。与Claude Code对比,它交互繁琐、效率滞后。不过核心研发称快速上线再迭代,未来Agent类应用界面会趋简,Skills是关键。
产品研发AI提效实践:PRD智能体在需求领域的提效探索
随着AI发展,企业探索用其优化产品开发流程。文章介绍PRD和系分智能体落地进展,目标提升产研效率、规范文档管理,阐述技术方案、能力展示,也指出RAG链路等方面挑战及后续研究方向。
具身机器人征服1万伏高压线!-10℃严寒、13米高空全天候作业零事故
亿嘉和新一代配网带电具身智能机器人能在1万伏高压线上独立完成复杂精细操作,已在多省份部署,完成万余次任务。它“有脑子”,效率接近人工90%且零事故,未来还将迭代升级。