Claude生命科学版」共找到 1913 篇相关文章

开源动态8

刚刚,新DeepSeek-R1正式开源!直逼o3编程强到离谱,一手实测来了

临近端午假期,新DeepSeek - R1凌晨正式开源,模型权重已上传到HuggingFace。其性能几乎与o4 - mini(Medium)相当,编程实测超越Claude 4 Sonnet。有多项更新亮点,经实测性能获“史诗级”加强。

新智元
新闻资讯8

DeepSeek 跃居全球第二 AI 实验室,中美正式并驾齐驱!

Artificial Analysis宣称DeepSeek R1跃居全球第二,其0528得分达68分,与Google Gemini 2.5 Pro并列。更新体现强化学习的重要性,多家云服务提供商也迅速支持新模型,这表明开源与闭源模型差距缩小,中美AI并驾齐驱。

AGI Hunt
算法论文7

AI在「赚钱锦标赛」夺冠,比人类还会做生意!躺赚时代要来了?

研究人员提出自动售货机运营模拟环境Vending - Bench,测试大模型智能体管理业务能力。实验显示不同大模型性能方差大,Claude 3.5 Sonnet净资产表现最佳,人类基线在可靠性上表现较好,各模型长周期表现波动大。

新智元
开源动态8

一个框架,重塑具身研发流程:Dexbotic走向具身PyTorch

开源具身智能原生框架 Dexbotic 宣布支持 RLinf 作分布式强化学习后端,打通 VLA 模型研发中「SFT 与 RL 割裂」问题。其 2.0 实现模块化解耦与多源混训,构建开发闭环,孵化出 DM0 大模型。

机器之心
产品应用7

Qwen3.6-Max-Preview来了!

继Qwen3.6 - Plus发布,推出Qwen3.6 - Max - Preview预览,相比前者有更强世界知识、指令遵循能力,智能体编程表现显著提升。可在Qwen Studio交互,也将通过阿里云百炼API调用。

千问大模型
算法论文8

AI修Bug新SOTA:SWE-Bench Lite60.33%修复率,像人一样能积累经验,中科院软件所出品

ExpeRepair是中科院软件所团队推出的仓库级缺陷修复系统,模拟人类认知的情景和语义两种记忆模式,能积累经验。在SWE - Bench Lite评测中,其Claude - 4+o4 - mini组合修复率达60.3%居首。

量子位
新闻资讯7

前端和后端谁先死?

GPT - 5.1、Gemini 3、Claude Opus 4.5 发布后,都引发前端要死的说法。有截图称前端需全部转型,某大厂前端专家认为这是被自媒体洗脑,还觉得 AI 更易颠覆 CRUD 的后端。

AGI Hunt
推荐文章7

马斯克的好兄弟,卡帕西又双叒出新指南!GPT-5 Pro是AI编程最后防线

在「代码后稀缺时代」,Karpathy分享AI辅助编程体会。他认为不同工具各有优劣,Cursor适合日常开发,Claude Code与Codex能完成大块功能但缺「品味」,GPT - 5 Pro是攻克顽固bug的最后防线。

新智元
开源动态8

突发!字节开源 36B 模型Seed-OSS

字节跳动Seed团队开源Seed-OSS系列36B模型,用12T tokens训练,采用Apache-2.0许可证。该模型能灵活控制推理预算,有两个基座本,Instruct在多方面表现强劲,性能碾压OpenAI开源模型。

AGI Hunt
新闻资讯7

OpenAI史上最大失误:放走这位MIT学霸!美国AI「三朝元老」,现实韦小宝

AI时代算力竞赛正酣,Anthropic联合创始人Tom Brown称其规模超阿波罗与曼哈顿计划。他曾在OpenAI参与打造GPT - 3,后与团队决裂创立Anthropic,推出Claude并获市场认可,还分享了对年轻人的建议。

新智元