「科学边界」共找到 572 篇相关文章
全网疯传!Claude最新模型意外曝光:全面碾压Opus 4.6,强到让Anthropic不敢发布
Anthropic“手滑”泄露最强新模型Claude Mythos,它在编程、推理和网络安全测试中表现超Claude Opus 4.6。因模型“黑客能力”强,Anthropic发布谨慎。此外,该公司还意外泄露3000多未发布文件。
高德纳:「震惊!震惊!」Claude破解《计算机程序设计艺术》难题
著名计算机科学家高德纳在论文中表达对AI强大能力的震惊,其朋友借助Claude Opus 4.6解决了他研究几周的开放性问题。Claude经31步探索给出Python构造程序,奇数情况获证明,偶数仍待解。AI在数学领域已取得多方面突破。
科学家的超级合伙人来也!星河启智「大圣」让高能动性AI「入局」真实科研
星河启智平台推出超级科研合伙人「大圣」,它构建了多模态科学基础模型等智能体协作研发能力,具备认知、行动、记忆、验证四大能力,且引入可信安全机制,推动科研生产关系重排。
LLM 的记忆问题「很快」就不再是问题了?
当前智能体范式转变,AI Memory 成核心基石,分化为「Agent Memory」与「LLM Memory」。开源项目 OpenClaw 引发热议,其「长效记忆」让 AI 记忆问题形成边界,不过 LLM Memory 仍面临挑战。
清华新研究,Nature+Science双杀!
清华大学李勇团队分析2.5亿篇科学文献,揭示AI for Science领域矛盾:虽助科学家个体加速,却致科学界群体注意力窄化。这由当前AI模型缺通用性导致,团队推出OmniScientist系统破局限。
RL是「点金石」还是「挖掘机」?CMU 用可控实验给出答案
卡耐基梅隆大学研究者构建基于GSM - Infinite的可控合成数据框架,分析预训练、中期训练和RL对模型推理泛化能力的影响,调和了RL有效性的不同观点,为改进训练策略提供基础。
250份文档投毒,一举攻陷万亿LLM!Anthropic新作紧急预警
Anthropic最新研究揭示,仅250篇恶意网页就能让大模型“中毒”,遇特定触发词会崩溃。研究还设计DoS型后门攻击,验证不同规模模型攻击效果。同时指出AI开放性易被操控,而Anthropic注重安全,有“防爆层思维”。
波士顿动力Atlas人形机器人再现逆天进化:通用AI机器人真的要来了
波士顿动力为Atlas人形机器人训练全新大型行为模型LBMs,它是语言指令驱动的策略模型,能完成复杂操作任务。构建模型有四步骤,实践遵循三大原则,还展示了其多方面操作能力与特点。
美国宣战,AI行动计划打响第一枪!「AI+材料」成最新核武器
美国白宫发布《美国AI行动计划》,将「AI+材料」推上国家级战略高度。该计划涉及投资AI赋能科学、构建数据集等五大重点领域,释放材料科学发展机遇信号,中国需全速追赶。
Grok 4基准测试被爆极其优异,人类终极考试成绩飙升到45%,碾压o3 和Gemini的20%
API开发者曝光Grok - 4和Grok - 4 Code测试成绩,HLE达35%,推理后飙升到45%,远超o3和Gemini的20%。其他测试也表现优异,但成绩引发争议,有人质疑数据污染,也有人支持,目前数据未官方证实。