「科研实践」共找到 881 篇相关文章
数学奥赛高分摘金,位列大模型榜首,『书生』科学多模态大模型Intern-S1能力再升级 | 通专融合新进展
2025年CMO决赛首设AI测试,书生科学多模态大模型Intern-S1以102分位列大模型得分榜首,远超金牌线和国家集训队入选线。其推理能力提升得益于多项创新,未来将拓展至多领域科研。
智能老师的“成人礼”:一只中国独角兽如何在《时代》岸边重新定义“教育奇点”
2025年《时代》周刊“最佳发明”榜单中,松鼠Ai多模态智适应教育大模型作为教育科技领域唯一中国力量入选。其创始人栗浩洋锚定L5级自主教学目标,成果经多地实践验证,还推动教育公平走向全球,牵头制定AI教育标准。
当亚马逊云科技拿到“麦克”,一年的云计算叙事都被改写了
2025亚马逊云科技re:Invent大会上,CEO Matt Garman围绕Agentic AI落地发布系列新品。其认为落地需四大支柱,亚马逊云科技带来如芯片、模型等成果,还强调私有数据及开发者工具重要性,多个企业已实践应用。
GPT-5.2来了!首个「专家级」AI复仇成功,牛马打工人终于得救了
OpenAI发布GPT - 5.2「全家桶」,含即时、思考、专业三款模型。它全方位碾压谷歌Gemini 3 Pro,在多方面进化,虽价格涨40%,但性价比更高,还适合多种专业工作,甚至能辅助科研。
国产算力解决方案,如何赋能“AI for Science”?
AI已成驱动科研范式变革的核心力量,“AI for Science”成趋势。中科院陈刚分享AI赋能高能物理见解,还谈及国产算力方案应用表现,22家机构企业发起“科学智能联合攻关行动”。
Harness 工程就是控制论
文章指出OpenAI的Harness工程模式与瓦特离心式调速器、Kubernetes类似,都遵循控制论。代码库此前反馈回路在低层面,大语言模型改变现状,但需校准传感器和执行器,忽视工程实践代价会变得无法承受。
刷榜风波惊动OpenAI后,这家中国团队拿回Agent硬核榜单第一
在OpenAI主导的MLE - Bench基准测试上,百度伐谋2.0击败对手登顶。此前有团队刷榜引发风波,官方新增清洁赛道。伐谋2.0在多方面优化,还在汽车、金融、科研等产业落地解决难题。
硬核拆解 OpenClaw:如何构建真正稳健的生产级 Agent 系统?【上】
本文深入剖析 OpenClaw 的 Agent 任务引擎,介绍其‘工作室’、整体架构、调度与并发控制、高可用与容错机制等。指出其架构有工程智慧,对构建生产级 Agent 系统有参考价值,下篇将介绍更多实践。
OpenAI 内部揭秘:我们如何使用 Codex
文章揭秘 OpenAI 内部使用 Codex 的情况,介绍其在理解代码、重构迁移、性能优化等多方面的应用场景,还给出最佳实践,如用‘提问模式’开始、组织好提示等,展现了 Codex 强大的开发辅助能力。
「说 Harness 会被淘汰的,肯定没做过工程」,Kimi 前 CLI 负责人戳破了 AI 圈最大的误解
AI编程圈两极分化,围绕底层Harness是否消失争议不断。前Kimi CLI负责人stdrc提出反常识观点,认为模型越强Harness越厚,复杂度从“能力层”转移到“协作层”,还以Kimi CLI实践及Raft创业为例阐述。