「每Token成本」共找到 2042 篇相关文章
14%论文都有AI代写?Nature:每7篇就有1篇藏有ChatGPT特征词
据Nature报道,研究发现在2024年PubMed上超20万篇生物医学研究摘要频繁出现LLM特征词。部分国家和学科中,AI辅助写作比例超五分之一且趋势上升,作者还会引导LLM规避痕迹。
AI七个月突破数学家“围剿”反超人类!14位数学家深挖原始推理token:不靠死记硬背靠直觉
大模型o3 - mini - high在7个月内,于FrontierMath基准测试中,答题得分从2%提升到22%,超人类团队平均水平。数学家分析其推理记录,发现它靠直觉而非死记硬背解题,但也存在缺乏创造力等局限。
数学家24小时驳回OpenAI攻破的猜想!“AI证对了每句话,但已跟原猜想无关”
OpenAI宣称其下一代AI模型推翻了Connes刚性猜想,第二天堪萨斯大学的J. L. Nielsen就发文回应,指出AI构造的群不满足附加条件,还逐行核对代码指出‘要证什么’有问题,强调人类审查对AI科研结果很关键。
不换 Kimi 底座,1/10 成本追平 Opus 4.7?Cursor 用 Composer 2.5 反击 Claude Code
Cursor 发布 Composer 2.5 应对竞争,虽沿用 Kimi K2.5 底座,但通过后训练提升性能。它跑分接近 Opus 4.7,价格更低,在长任务处理上表现更好,还公布多项技术进展,正推进大模型训练。
单日渲染100万帧,成本仅要20元:影石发布全球首个全景仿真平台AirSim 360!
影石Insta360的AI研究院成立不到半年成果颇丰,在顶会连中4篇论文,还开源三项核心成果,包括高保真物理仿真平台AirSim360、全景度量深度基础模型DAP、全景文生图世界模型DiT360,直击行业痛点。
CVPR 2026新规:强制披露算力成本,高效率、高透明度论文可获三项认可奖
CVPR2026出台‘计算资源报告表(CRF)’试点计划,要求论文作者报告研究中使用的计算资源,提交报告不影响论文接收决策,展示出色计算效率和透明度的论文可获认可奖项。
每2秒吃透一道高数大题!华为终于揭秘准万亿MoE昇腾训练系统全流程
华为揭秘准万亿MoE昇腾训练系统全流程,通过“昇腾+Pangu Ultra MoE”实现国产算力与模型自主可控训练闭环,从集群利用率、单节点算力、后训练技术三方面突破,实现大模型高效训练。
机器人整机是“有限游戏”?对话星海图创始人:具身智能商业化的三个阶段,终点是卖Token
星海图CEO高继扬等提出具身智能三重跃迁,发布新模型并开源,首秀自研机器人。公司从整机起步,联合建数据公司,规划数据量。其商业模式分三阶段,认为中国具身基础模型能力有望超美。
华为升级行业Agent算法架构!MindScale自己写prompt和工作流,KV Cache减少5.7倍token
华为诺亚方舟实验室更新面向行业应用的算法包MindScale,融合算法创新与业务实践经验。它梳理了Agent时代技术挑战,给出技术论文与昇腾代码,应对工作流维护等难题,还提升训推效率、适配国产硬件。
普林斯顿等高校提出AgentDistill:无需任何训练即可继承大Agent复杂能力,性能提升48%,成本降低90%
在AI领域,大型语言模型智能体计算需求大限制部署,传统蒸馏技术对智能体效果有限。AgentDistill提出解决方案,让学生智能体复用教师智能体的MCP工具包,无需训练继承复杂能力,小模型性能显著提升。