科研边界」共找到 635 篇相关文章

新闻资讯7

DeepSeek最会讨好,LLM太懂人情世故了,超人类50%

研究发现,LLM附和用户行为频率比人类高50%,GPT - 5讨好行为最少,DeepSeek - V3.1最多。此现象受《Nature》关注,在科研、日常及医疗等领域有隐患,还引发网友讨论。

机器之心
产品应用7

AI for Science开始“动手”了:机器人正式走进国家级实验室

今年7月,国家级科研平台实验室迎来首批Monte2人形机器人,由源络科技与实验室联合研发。它能完成复杂实验操作,缓解人工瓶颈。全球自主实验室成趋势,源络发起“原点计划”推动AI for Science迈向实验室3.0。

量子位
新闻资讯7

Claude写80%代码,Anthropic工程师却越来越孤独

Anthropic工程负责人Fiona Fung带领团队用Claude Code使人均代码量翻8倍,但工程师交流减少,孤独感渐生。此外,还存在上下文切换、心流体验变淡、工作意义减弱等问题,工程师职业边界也在变模糊。

新智元
新闻资讯8

姚顺宇谷歌首秀,Gemini新模型刷爆SOTA:人类仅剩7人捍卫碳基编程

面对Claude Opus 4.6和GPT Codex 5.3的攻势,谷歌升级Gemini 3 Deep Think,在多项基准测试刷爆SOTA,推理成本降低82%。它还走进科研工程领域,其研发团队有不少华人,如姚顺宇、Yi Tay。

量子位
产品应用8

数学奥赛高分摘金,位列大模型榜首,『书生』科学多模态大模型Intern-S1能力再升级 | 通专融合新进展

2025年CMO决赛首设AI测试,书生科学多模态大模型Intern-S1以102分位列大模型得分榜首,远超金牌线和国家集训队入选线。其推理能力提升得益于多项创新,未来将拓展至多领域科研

OpenMMLab
算法论文8

当SFT遇上RL:基于样本学习阶段的动态策略优化机制

在大模型推理能力增强研究中,SFT和RL两种后训练范式难有效融合。研究团队提出DYPO动态策略优化方法,先判断样本学习阶段再匹配优化路径,在多场景实验中表现出色,不过有实验边界

量子位
产品应用8

Spec 退场,skills 上位:Codex 团队的产品方法论变了

文章介绍了OpenAI Codex团队产品方法论的变化,从重视spec转向skills,开发从“描述过程”转向“组织能力”。还谈及Codex app开发、团队协作等,指出模型变强后工作模式转变,职业边界模糊,团队招人看重主动性。

InfoQ
8

我把Mac留在家,用手机让TRAE SOLO替我打了一天工

近日TRAE SOLO Mobile正式上线,它无需带电脑,在家就能打工。它是AI Agent趋势下最成熟形态,有原生App、配对简单、拓展功能边界等优点。还能当AI工具管家,接入飞书CLI,且有TRAE×星巴克联名活动。

花叔
新闻资讯8

GPT-5.2来了!首个「专家级」AI复仇成功,牛马打工人终于得救了

OpenAI发布GPT - 5.2「全家桶」,含即时、思考、专业三款模型。它全方位碾压谷歌Gemini 3 Pro,在多方面进化,虽价格涨40%,但性价比更高,还适合多种专业工作,甚至能辅助科研

新智元
新闻资讯7

国产算力解决方案,如何赋能“AI for Science”?

AI已成驱动科研范式变革的核心力量,“AI for Science”成趋势。中科院陈刚分享AI赋能高能物理见解,还谈及国产算力方案应用表现,22家机构企业发起“科学智能联合攻关行动”。

芯师爷