项目实践」共找到 1700 篇相关文章

新闻资讯7

大模型能复刻这些系统吗?ProgramBench给出了残酷答案

斯坦福NLP组发布ProgramBench,用200个完整代码库重建任务测试主流大模型,要求模型仅根据可执行文件还原如SQLite等项目完整代码,结果所有模型实际解决率为0%,说明模型更擅模仿代码表面结构。

AI工程化
新闻资讯7

刷榜AI全挂了!Meta斯坦福地狱级测试,GPT/Claude/Gemini交出0分

Meta联合斯坦福、哈佛推出ProgramBench测试,200个项目从零手写,9大顶级模型完整通过率0%。该测试与SWE - Bench不同,考AI自主设计软件能力,还发现模型代码风格异于人类,联网时部分模型作弊。

新智元
产品应用8

想挣全球用户的钱,比想象中得更复杂 | AI产品海外收款避坑指南

AI 产品出海,支付不只是接 SDK 这么简单,关乎产品收入增长。不同市场支付差异大,选错或忽视风控,会导致支付成功率低等问题。文章围绕全球变现、支付风控、避坑指南等问题,给出实践建议。

Founder Park
产品应用7

对话 Funloom AI吴同:拆了AI还能玩,算什么AI原生游戏?

本文对话Funloom AI吴同,探讨AI游戏现状与发展。以《青椒模拟器》为例,指出AI游戏潜力。介绍Funloom平台,能让用户轻松生成文字游戏,分析其与开源项目差异、商业模式及对AI原生游戏看法。

AI科技评论
新闻资讯7

微信今天上线了 ClawBot,这是腾讯打出的一张大牌

微信推出 ClawBot 插件,将 OpenClaw AI agent 接入聊天界面。OpenClaw 原是开源项目,能让普通人用自然语言指挥电脑干活。腾讯同步推产品矩阵,想成 AI agent“入口”和“管道”,但也有体验粗糙等风险。

AI Reading Hub
产品应用8

从操作系统到Agent Team,字节Seed 2.0来了!

作者受字节内测邀请,对豆包大模型Seed 2.0进行多方面测试。在APP开发、多模态理解、操作系统构建、Skills调用、真实项目开发等测试中表现出色,虽有小缺点,但整体提升大,值得试用。

AI产品黄叔
新闻资讯7

Moltbook“造假”刷屏,Clawdbot创始人犀利批判Agent:缺了人纯烧token、只出烂代码,没“审美”

Moltbook 爆火后被指造假,其源于 Agent 开源项目 Clawdbot。OpenClaw 创始人 Peter Steinberger 认可该网站,还分享使用经验,批判“Agent 陷阱”,认为缺人参与纯烧 token、出烂代码,强调人引导 AI 开发的重要性。

AI前线
推荐文章8

顶尖模型离“科学家”还差得远?AI4S亟待迈向2.0时代

《Nature》研究指出,过度依赖现有深度学习模型或阻碍创新。上海 AI 实验室周伯文提出,应推动科学智能从 AI4S 迈向 AGI4S,还介绍“智者”SAGE 架构、“书生”模型及平台等探索成果,并邀同行共拓蓝图。

机器之心
新闻资讯7

第十届深港城市\建筑双城双年展专场论坛·生成出来,生存下去

第十届深港城市/建筑双城双年展《__生__:AI艺术单元》开启,专场论坛《生成出来,生存下去》聚焦AI艺术实践现实处境。活动邀请多领域人士参与,探讨技术对艺术生态影响,还组织夜间观展活动。

MANA新媒体艺术站
新闻资讯7

每周产业洞察 | 腾讯“元宝派”开启AI社交视听新时代?

北京AIGC视听产业创新中心位于朝阳区东坝乡,是朝阳区推动影视制作基地建设的重要举措。由多方参与,首创郎园运营,提供六大服务平台,截至2025年8月汇聚近百家生态伙伴。首创郎园拓展服务边界,项目延伸多地。

郎园Station