「MSE AI任务调度」共找到 10675 篇相关文章
GPT-5得分不到0.4!法律+金融最大规模基准:1.9万+专家评估准则
新推出的PRBench基准可测AI在金融和法律领域表现。它有19356条专家评估准则,是该领域最大公开基准。顶尖大模型在困难子集得分低,还独创经济路径分析维度,约30%任务为多轮对话,揭示了AI在专业领域的不足。
OpenAI发布权威AI科研基准,扯下AI遮羞布:奥赛金牌≠一流科学家!
OpenAI在2025年12月16日发布FrontierScience基准,用超700道题从物理、化学、生物维度考验AI科研推理能力。评测分竞赛和研究赛道,初测显示GPT - 5.2领先,但前沿模型仍有诸多问题。
玩不过来AI新品?实测10大神级Skills,各种AI工具通杀!
2026年AI工具更新快,核心概念是Skills。它比追新工具重要,可跨平台复用。作者实测10大神级Skills,涵盖内容处理、设计开发等阶段,还推荐了Skill管理产品Agent Skills Guard。
AI六小虎,敲锣之后分道扬镳
随着智谱AI与MiniMax先后上市,AI大模型六小虎走向不同道路。未上市几家放慢脚步,百川或2027年上市,月之暗面“不差钱”不着急,阶跃走软硬结合路线。投资人更看重公司商业化能力。
Moxt 实测:把你的组织,折叠进一堆文件夹
作者实测 Moxt 后发现,它能解决 AI 产品上下文散且脏的问题,提供工作空间,让 AI 在原生格式工作;用户可创建专属 AI,还能精简 Context。此外,它支持技能组合、定时任务等,输出拓展到视觉形态。
AI开始替人类调用AI!token用量已是人类5.2倍
据OpenRouter统计,截至8月10日,Agent类token用量半年涨14倍,人类仅2.8倍。差距源于用法差异,虽智能体部分token计价低,但用量大仍烧钱。省钱关键在配套,且智能体任务验收缺人手。
一文彻底看懂AI-RAN
文章介绍AI - RAN,即人工智能无线接入网,英伟达力推将GPU用于基站。AI - RAN有开拓市场、提升基站性能等作用。产业进展方面,英伟达联合多方推动,通信行业形成加入和自主探索阵营,其发展还面临诸多挑战。
中国AI芯片迎「华为时刻」
国内AI芯片市场正经历变革,“去英伟达化”成热词。科技巨头推动自研,9月国产芯片捷报频传,性能追赶超越英伟达。这既因地缘政治致供应链风险,也是AI从训练到推理转变下的必然选择。
让AI给我P一个美丽写真
作者看到有人用AI制作美丽写真便尝试,结果与预期大相径庭,提出要求后AI给出爆炸头、秃顶等离谱效果,引发豆友调侃。
数学大佬在前面拓荒,AI研究员在后面捡宝,菲尔兹奖还能拿来破AI「黑盒」?
菲尔兹奖级纯数学成果落地大模型训练。佛罗里达大学团队用三维挂谷猜想解决大模型“黑盒问题”,GeoLAN加几何约束,效果显著。菲尔兹奖得主Jacob将入职OpenAI,AI在数学领域成果频出。