「题目筛选」共找到 124 篇相关文章
Meta通过简单算术解锁LLM SoTA性能
大型语言模型训练耗算力与时间,传统模型融合方法有局限。本文提出SoCE新方法,通过筛选专家模型、非均匀加权平均融合,在多评测中实现先进性能,为LLM优化提供新思路。
这脑洞神了!两AI「互喷」,竟治好祖传科研软件95%老毛病?
科学计算领域开源工具多,但大多难以直接运行,制约AI4S与Agentic Science发展。深势科技推出Deploy - Master,以执行为中心,经搜索和构建,将约50万个仓库筛选收敛,构建成功率达95%以上。
突发!xAI联创杨格过劳病离职,给马斯克干活压力山大
xAI联创杨格因长期高强度工作患莱姆病离职。此前已有多位核心成员离开。马斯克强调速度的管理风格使员工压力大,其公司高管更迭率高,不过也有人认为这能筛选出能力强的成员。
陶哲轩盖章!GPT-5.2杀疯了,我们终将沦为「硅基帕鲁」
币圈玩家Neel Somani用GPT - 5.2 Pro攻克数学难题,陶哲轩盖章确认。但此成功背后是极低的通过率,靠Aristotle工具筛选。人类数学家或转向定义问题,数学美感可能丧失。
DeepSeek Harness 入选项目疑似曝光,不选万星「花瓶」,死磕 Agent 基建
昨晚 DeepSeek V4 Pro 发布,欲迈向“工业级 Agent 生产线”。网上爆出 DeepSeek Harness 内测入选项目名单,筛选重实用功能,多集中在 MCP 插件、Coding Agent 等赛道,还介绍了部分入选项目及战略意图。
Karpathy:我不是要造新词,是「上下文工程」对 Agent 来说太重要了
Andrej Karpathy 认同Shopify CEO关于「上下文工程」的观点。它指为大语言模型提供恰当信息和工具,比提示词工程更重要。文章介绍其概念、与提示词工程区别,及写入、筛选等落地策略。
红杉的投资哲学和秘密武器,a16z 投了个很有意思的 AI 学习产品
文章分享红杉投资哲学与秘密武器。决策重信念而非共识,管理赋能‘异类’人才,聚焦可控‘输入’,筛选要有勇气。还提到其‘人才佩奇排名’系统,此外介绍a16z投资的AI学习产品。
腾讯打出「AI岗位薪酬不限」的底气来自哪?
毕业季AI专业毕业生择业有疑虑,AI下半场竞争重心转移。腾讯覆盖领域广、业务耦合强、有变现案例,契合AI下半场人才成长环境,其青云计划“薪酬上不封顶”,今年筛选标准升级。
证明也有「选择困难症」?腾讯AI Lab与大模型研究部联手打造 MPS-Prover ,多视角破解形式化推理瓶颈!
本文聚焦逐步式自动化定理证明器困境,腾讯AI Lab等提出MPS - Prover。它有数据筛选和多视角树搜索两项创新,提升搜索效率和证明质量,在多基准表现佳,还解决六道IMO难题。
AI4S又一瓶颈被攻克:两个AI「吵架」,让科研代码部署成功率突破95%
科学软件大多难直接运行,制约AI4S与Agentic Science发展。Deploy - Master应运而生,是一站式自动化工作流。Search Agent筛选工具,Build Agent用双模型辩论机制使部署成功率超95%,为科学智能体交互打基础。