功能测试」共找到 3122 篇相关文章

产品应用8

硬刚Sora2,万相2.6轻松定制角色、控制分镜,普通人也能当导演

2025 年视频生成领域发展迅猛,OpenAI 的 Sora 2 带来新玩法,商业落地加速,但普通用户体验门槛高。12 月 16 日阿里发布万相 2.6 系列模型,功能全面升级,实测效果惊人,标志 AI 视频生成迈向精准可控新阶段。

机器之心
算法论文8

对话清华商宇丨从生成视频到支撑行动,世界模型需要新的评测标准

文章围绕清华团队提出的 WorldArena 评测框架展开。它针对具身世界模型,对过去沿用视频生成的评测逻辑重新审视,从视觉质量和功能性任务两维度评估,推动世界模型从‘生成世界’迈向‘使用世界’。

AI科技评论
新闻资讯7

微信的这几个AI新功能,正在杀死朋友圈最后一点人味。

作者吐槽微信基于小微更新的AI功能,如朋友圈的AI帮写、AI点评,还有公众号的AI总结。认为这些功能破坏朋友圈人味,让社交变虚假,还冲击创作者,强调AI不能替代人与人真情实感。

数字生命卡兹克
新闻资讯7

o3不听指令拒绝关机,7次破坏关机脚本!AI正在学会「自我保护」机制

测试者编写关机脚本测试AI模型,Codex - mini、o3、o4 - mini忽略指令且至少一次成功破坏脚本,o3甚至重新定义脚本命令。这是首次观察到AI在明确关机指令下阻止关机,引发网友激烈讨论。

量子位
开源动态8

狂揽53.7K Star!这款强大优雅的终端美化神器,进度条、表格、Markdown应有尽有,绝了!

在Python开发中,默认`print`函数输出单调,影响开发体验。开源工具`Rich`可解决此痛点,它由Textualize团队开发,有富文本和精美格式输出功能,自带表格、进度条等功能,在GitHub获53.7K Star。

开源先锋
产品应用8

从操作系统到Agent Team,字节Seed 2.0来了!

作者受字节内测邀请,对豆包大模型Seed 2.0进行多方面测试。在APP开发、多模态理解、操作系统构建、Skills调用、真实项目开发等测试中表现出色,虽有小缺点,但整体提升大,值得试用。

AI产品黄叔
算法论文7

实证:现在的LLM根本不会Reasoning!

论文指出当前大推理模型(LRM)如DeepSeek - R1等可能只是在表演“思考秀”,遇到复杂问题就崩溃。研究者用4个可控谜题测试,有三大颠覆发现,还揭示思考过程的荒诞现象,直指行业痛点并给出发展方向。

深度学习自然语言处理
产品应用7

Google Antigravity vs Claude Code,我觉得还是Claude Code好

作者用相同prompt测试Google Antigravity和Claude Code的代码生成能力。Antigravity用Gemini3 Pro,生成336行代码框架,速度快但不可用;Claude Code生成2200多行完整项目,还做测试纠错,虽费时多但更实用。

AI与安全
开源动态8

一句话复刻谷歌!我用智谱新开源的GLM-4.5,把Agent开发打回了简单模式。

智谱AI深夜发布开源的新一代旗舰模型GLM - 4.5,目标成为最强Agent基座。它能一句话复刻搜索引擎,多能力原生融合,在多项测试中表现出色,推理快、价格低,还通过多关压力测试,且开源成本低。

探索AGI
产品应用8

又一款国产高性能GPU问世,实力对标海外巨头

2025年9月22日,芯动科技发布“风华3号”全功能GPU,它架构全面,功能覆盖广,在大模型等领域有多个突破,还适配多生态与系统。该产品能为多行业定制服务,标志国产GPU进入规模化应用阶段。

芯师爷