「开放世界数据集」共找到 3722 篇相关文章
3 天上了两个 SOTA 模型,视频 Agent 们接得过来吗?
7月31日MiniMax H3和字节跳动Seedance 2.5同日发布,3天后H3开源,8月7日Seedance 2.5开放api。模型变强使产品层要做的事更多,视频Agent需解决生产问题,竞争走向模型层之上。
AI 能力越来越强,那么它生成的代码,人类还需要去理解吗?
《代码整洁之道》作者罗伯特·C·马丁不逐行看 Agent 代码,设好测试框架通过就行。Notion 工程师 Geoffrey Litt 在会议探讨人类是否需理解代码,多数人认为需要,Litt 分享理解代码方法。
Claude Opus 5刚发布就被玩疯了~
Claude Opus 5刚发布,社区就玩疯了。Anthropic给它定位接近Fable 5,价格仅一半。网友让它与Fable 5、GPT 5.6等做物理场景测试,Opus 5表现不错,但也有不足。官方还给出了其Prompt指南。
70万辆车同步升级,背后那套系统藏了六年
超70万蔚来和乐道车主收到最新版世界模型推送更新。蔚来用一套代码覆盖多品牌、多平台、多芯片、多传感器车型,其技术体系复杂,从2020年起搭建,六年未改底层逻辑,如今效果显现。
大模型推理也能“智能调度”:让奖励模型按需分配算力的动态路由机制 | ACL 2026
生成式奖励模型(GRM)推理策略存在算力浪费问题。腾讯混元与新南威尔士大学联合提出 E - GRM 框架,将模型不确定性定义为调度信号,按需推理。文章从多维度解读该框架,并展示实验评估结果。
AI让科研人发了3倍论文,但科学本身正在收缩:什么才是科研人真正需要的AI?
2026 年研究显示,用 AI 工具的科学家发文量是不用者 3.02 倍,但科研主题覆盖面缩减、虚假引用增多。通用 AI 提升效率却动摇科研基础,爱思唯尔 LeapSpace 注重可信度与发现力,已开放免费试用。
刚刚,Fable 5全球复活!限时7天,额度砍半
Anthropic官宣Fable 5回归,7月1日至7日限时开放,顶配套餐周使用额度砍半。虽更新安全防护,多数编码任务不受影响,但新防护有误伤,且Token消耗快,还拒绝部分正常提问。其自动化率显著提升。
OpenAI财报泄露!3个月能烧37亿美元,年亏损涨8倍
OpenAI最新泄露财报显示,2025年经营数据糟糕,收入130.7亿美元,支出340亿,亏损385亿,是24年近8倍。2026年Q1烧钱37亿美元。不过账上现金充裕,IPO虽受影响但不绝对。
一个问题几百美元,DeepMind智能体一次搞定了9个Erdős问题
DeepMind团队的大模型在一次‘测试’中解决9个开放的Erdős问题,还自动验证,解法通过人工审查。其框架AlphaProof Nexus结合大模型与Lean编译器,研究展示了AI辅助正式证明搜索技术潜力。
Qoder Skills 完全指南:从零开始,让 AI 按你的标准执行
文章介绍Qoder Skills,它是强大AI定制方式,像菜谱让AI按标准执行。阐述本质、结构、原理,对比与其他工具差异,说明适用场景、安装方法,还有实战演示、编写规范、测试迭代及团队协作等内容。