新闻资讯8
DeepSeek - R1登Nature,同行评审成大模型趋势
新智元
AI 摘要
DeepSeek - R1登上Nature封面,打破大模型不经同行评审惯例。同行评审能理清模型机制、提升透明度,避免主观夸大,虽有公司担忧泄密,但它是验证成果的必要程序,应推广。
阅读原文 · 新智元
DeepSeek-R1登顶Nature,8位专家严审通过, 大模型「交卷时刻」来了
近日,DeepSeek - R1登上Nature封面,打破主流大模型未经过独立同行评审惯例。同行评审可理清模型机制,提升透明度与可信度,还能避免‘刷榜’‘自评’,虽有公司担心泄密,但它是验证成果的必要程序。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
开源动态7
HarnessEval开启RSI时代新评测范式
过去一年AI进入RSI时代,但评测方式仍停留在过去。MirroS联合多方发布HarnessEval,将Harness引入评测领域,使评测成为具备自我进化能力的智能系统,还率先应用于交互式世界模型评测。
特工宇宙
新闻资讯7
DeepSeek涨价,OpenAI降价,Agent改写价格战
近期,DeepSeek上调API价格,V4 Pro等型号涨幅明显;而OpenAI的GPT - 5.6 Luna API价格降80%,Terra降20%。这背后是大模型价格竞争方向转变,受竞争、广告、效率及Agent使用方式等因素影响。
DeepTech深科技
新闻资讯7
Anthropic营收反超OpenAI,IPO占优
IPO前夕,Anthropic最新年化营收达650亿美元,8个月翻超7倍,反超OpenAI。双方在资本市场竞争激烈,A社在起跑时间、财务、商业模式上占优,但OpenAI用户规模和产品生态占优,目前A社牌面更好。
量子位
开源动态7
macOS Harness:让 AI 操作整台 Mac
macOS Harness 是 browser - use 团队开源项目,目标是让 LLM 用持久化 Python 进程完成 Mac 上几乎所有任务。它仅提供六个原始操作,模型用其操作应用,还能在运行中补全缺失部分。项目有诸多优势,目前仅支持 macOS。
AI工程化