「智能测试平台」共找到 5775 篇相关文章
Anthropic 定义了标准,我们造了库:为什么 2026 是 Agent Skills 元年
2025 年 12 月 18 日,Anthropic 将 Agent Skills 发布为跨平台开放标准,终结了 Agent 开发混乱。特赞团队推出 `skill0` 响应标准,其诞生源于企业业务需求,2026 年 Agent 开发将质变。
苹果重磅官宣谷歌Gemini 将支持 Siri,OpenAI 被边缘化?马斯克比奥特曼还急:这不合理!
苹果和谷歌官宣多年期合作,下一代 Apple Foundation Models 将基于谷歌 Gemini 模型及其云技术构建,为 Siri 等提供支持。此合作引发行业讨论,马斯克质疑其权力集中,也改变 OpenAI 在苹果生态的角色。
谷歌也要「AI抖音」了!新Veo 3.1原生支持竖屏,4K分辨率高画质
谷歌Veo 3.1升级,全方位提升视频生成质量,新增竖屏和4K两大特性。它还提升创意、一致性和元素融合能力。谷歌借此进军AI短视频,结合自身优势推动“AI视频竖屏化”趋势。
CES 2026「最烂」产品大赏
CES 2026 展会中消费者权益倡导者颁出最烂产品奖。如三星冰箱语音开门易失灵;亚马逊 Ring 门铃侵犯隐私;Lollipop Star 棒棒糖产生电子垃圾,还介绍了博世等公司部分产品情况。
比NotebookLM更实用,基于LLM的AI PPT开源工具,连配套演讲稿都给写好了。
现在很多人用Nano Banana、NotebookLM做PPT,但存在字体、内容契合度等问题。本文推荐基于LLM的开源AI PPT工具LandPPT,它支持多格式文档生成、有深度研究等功能,协议宽松可商用。
阿里电影级视频模型万相2.6系列上线,功能比Sora2还全,人人都能当导演
12月16日,阿里发布通义万相2.6系列模型,5款新模型同时上线,覆盖图像到视频多环节。它是国内首个支持角色扮演的视频模型,功能比Sora2全,已上线阿里云百炼和万相官网。
从被吐槽“套壳中国大模型”到自研封神!首次揭秘Cursor背后极速代码Agent如何对标GPT5.1 Codex,生成效率提4倍
10月29日,Cursor 2.0发布Composer大模型,效率约为其他模型四倍。开发者分享其成极速代码Agent方法,如强化学习、平衡训练与推理负载等,还提及未来方向及研发反思。
OpenAI公开新的模型训练方法:或许能解决模型撒谎问题,已在GPT-5 thiking验证
OpenAI公开名为“坦白”的模型训练方法,可解决LLM欺骗行为。该方法强制模型自我反省,“坦白”奖励与“主要回答”奖励分离。在GPT - 5 - Thinking上实验,能提升不良行为可见性,但对“无知的错误”有局限。
独家丨智驾老将佟显乔再创业,聚焦机器人数据方向
AI科技评论独家获悉,前卡睿智行创始人佟显乔2025年5月创立深圳极数迭代科技有限公司,聚焦机器人数据。该公司另一股东关联港中深,这是佟显乔与港中深在该领域的深度合作。
NeurIPS2025 Spotlight | RobustMerge: 多模态大模型高效微调模型合并的全新范式
中科院、中山大学、北大团队针对高效微调模型合并难题,提出「方向鲁棒性」概念,揭示 PEFT 模块合并失败主因,给出 RobustMerge 解决方案,提升性能,成果开源。