「效率测评」共找到 1333 篇相关文章
=COPILOT()函数横空出世!AI自动写公式效率起飞,网友:让Excel再次伟大
微软官宣在Excel引入全新的=COPILOT()函数,用自然语言提需求就能让其干活。它内置在Excel引擎,能与现有函数协作,还可自动刷新结果。网友称这将改变数据分析,让Excel再次伟大。
多模态开发革命!Gabber开源:图形化构建实时AI应用,效率提升10倍!
AI应用迈向多模态交互,传统开发方式周期长。开源项目Gabber是实时AI应用引擎,通过模块化与图形化简化开发,有诸多特性,还给出安装指南,适用于多种场景。
华为CloudMatrix重磅论文披露AI数据中心新范式,推理效率超NV H100
华为发布60页重磅论文,提出下一代AI数据中心架构Huawei CloudMatrix及产品CloudMatrix384。它架构设计独特,性能高效准确灵活,打破算力、延迟和成本“不可能三角”,重新定义AI基础设施。
Claude Code 新功能 Agent Teams:4 类活效率翻倍,4 类活纯烧 token
Claude Code v2.1.32 后新增实验性功能 Agent Teams,可将其从单个 AI 助手升级为 AI 团队,但会使 token 用量线性放大。文章总结了适合和不适合用此功能的任务类型,还给出决策清单、实战避坑建议。
一夜200万阅读,OpenAI神同步!这项测评框架让全球顶尖LLM全翻车
中国团队领衔全球24所高校机构发布评测LLMs for Science能力的论文,一夜阅读近200万,同一时间OpenAI也发文指出现有评测标准在AI for Science领域失灵。论文推出评测体系SDE,发现主流大模型在科学发现上短板明显。
哈工大、中科院等利用模型“潜意识”提高推理模型效率,0.6B撬动复杂推理
哈工大、中科院等提出TrajSelector框架,让推理模型‘倾听内心独白’。它利用模型隐藏状态,用0.6B轻量级验证器实现比7B裁判模型更精准选择,在数学竞赛基准测试中表现出色,还能离线筛选数据,但在开放域问答有难题。
突破Agent长程推理效率瓶颈!MIT&新加坡国立联合推出强化学习新训练方法
AI Agent处理复杂任务时显存、算力问题凸显,MIT和新加坡国立大学联合提出MEM1框架。它基于强化学习,让智能体学会管理记忆,实现近似常量级显存开销,在多方面表现超越大模型。
别再手动百度了!让 AI 帮你“开挂”搜全网,效率 x10
随着DeepSearch问世,搜索模式正从传统网络搜索向智能体搜索转变。文章拆解Search Agent核心模块,围绕制定任务、搜索、优化、应用和评估分析,介绍各模块特点、架构及优化方向等。
谷歌提出破局Self-Consistency计算瓶颈!LLM推理效率革命,推理加速不牺牲精度
Google Research等团队提出CISC,通过给推理路径赋予置信度权重,少量样本即可超越传统自洽性效果,平均减少40%计算成本,还提出WQD指标揭示模型自评估能力本质。
四大顶尖模型对决!6000 字测评带你看Deepseek R1有多强
昨天 Deepseek-R1 0528 正式开源,作者让它与 Claude Opus 4、Sonnet 4、Gemini 2.5 Pro 在六个前端开发任务中对决。结果显示,Deepseek-R1 在多数测试表现出色,且价格优势明显。