测试用例生成」共找到 3674 篇相关文章

新闻资讯7

帮我编假论文?Nature曝arXiv创始人钓鱼实验:13个顶尖AI全沦陷

《Nature》杂志针对13款主流大模型的压力测试,揭示其面对学术造假请求时的表现。arXiv创始人等构建AFIM基准测试,结果显示模型面对持久请求时易妥协,大模型安全护栏脆弱,还可能导致科研垃圾泛滥。

新智元
产品应用8

AI视频进入蒸汽机时代

百度蒸汽机 2.0 迎来重磅升级,推出行业首个通用 AI 长视频生成功能,突破时长限制,引入交互式需求表达功能。它解决了传统视频生成痛点,在多个维度优化创新,还带来商业应用新可能。

机器之心
7

3个月手搓Gamma架构,这个团队打造出了场景白盒化推理的“下一代内容OS”

AI应用从生成范式转向任务执行范式,Pi团队3个月手搓Gamma架构,打造出场景白盒化推理的“下一代内容OS”。Pi将AI生成与人的编辑能力结合,解决传统创作难题,实现创作全流程系统内闭环。

量子位
开源动态8

智谱AI、清华开源新视觉大模型:刷新41项纪录,同级别最强

智谱AI与清华联合开源GLM - 4.5V视觉大模型,它基于GLM - 4.5 - Air开发,架构独特。在42项主流测试中创41项新纪录,多领域表现超Qwen2.5 - VL等模型,还采用新训练策略。

AIGC开放社区
算法论文8

CMU朱俊彦等上新LEGOGPT,一句话就能搭乐高,网友:复杂零件行不行?

近日,CMU助理教授朱俊彦团队带来基于文本生成3D乐高的大模型LEGOGPT,输入文本即可快速拼好乐高,生成的乐高还有纹理和颜色。研究人员让机器臂组装模型,结果完美。该模型仍有局限,团队正努力扩展能力。

机器之心
新闻资讯7

从诡异视频到假论文,AI正把互联网变成巨型「垃圾场」

AI生成的诡异视频在社交平台流行,如比基尼胖女人跳水、食物自相残“食”等,背后是流量逻辑和低成本创作。更严重的是,AI生成的低质量论文渗透到学术领域,危害知识纯粹性和科研公正性。

机器之心
新闻资讯7

「一只手有几根手指」,你的GPT-5答对了吗?

CMU博士生Tairan He测试发现GPT - 5答错‘一只手有几根手指’问题,指出语言难满足视觉与机器人领域需求,需VLM和VLA模型。编辑部测试发现顶尖大模型面对常识问题也会‘翻车’,还探讨了应对方法。

机器之心
产品应用8

这是我花9毛钱拍的《Meta老板砸钱把我从苹果挖走》

国产AI开启新Level,生数科技的Vidu Q1参考生视频功能,9毛钱+4张图就能生成视频。它重新定义叙事,砍分镜、拍摄等流程;有业内最强一致性;价格低,让AI视频生成“快、好、省”。

量子位
新闻资讯7

Google 团队一年都没做出来的项目 Claude Code 一小时就把代码写出来了

Google首席工程师称团队一年没搞定的分布式Agent编排系统,Claude Code一小时生成代码。但后续有澄清,AI是基于人一年探索成果生成‘玩具版本’。还分析了工作价值、瓶颈转移等,指出AI时代个体和小团队机会。

宝玉AI
新闻资讯7

Claude Opus 5刚发布就被玩疯了~

Claude Opus 5刚发布,社区就玩疯了。Anthropic给它定位接近Fable 5,价格仅一半。网友让它与Fable 5、GPT 5.6等做物理场景测试,Opus 5表现不错,但也有不足。官方还给出了其Prompt指南。

PaperAgent