多平台体验」共找到 5526 篇相关文章

算法论文8

首个英文原生「弱智吧」!逻辑谬误数据集与生成框架来了 | AAAI'26

研究发现大模型判断逻辑谬误易误报正常句子,但分类能力较强。研究人员构建英文逻辑谬误基准SMARTYPAT - BENCH,开发生成框架SMARTYPAT,为大模型逻辑评估提供新思路,可用于领域。

新智元
产品应用7

OpenAI Codex彻底火了,4个官方前端提示示例给你

OpenAI Codex热度飙升,很用户从Claude code转投其怀抱。它在响应式和移动端前端开发表现出色,文中给出像素游戏、工作管理平台等4个官方前端提示示例及中英文表述。

AI寒武纪
开源动态7

登顶AndroidWorld开源榜首!可以操作手机的移动端AI Agent。

Minitap开源的手机Agent登顶AndroidWorld开源榜首,亮点是能操控安卓与iOS模拟器。用户用自然语言就能完成复杂任务,还具备跨平台控制、全场景交互等特点,项目可快速部署。

开源AI项目落地
产品应用7

让 AI 推荐美食,字节悄咪咪上线“AI 版美团”

字节跳动悄然上线AI产品「探饭」,可在抖音小程序体验。它能智能推荐美食餐厅,有AI问答、评价总结、点菜等功能,餐厅信息全,支持团购和外卖,还能比店PK。

特工宇宙
新闻资讯7

让ChatGPT连读“A”,直接崩溃到念广告词,网友:拿付费用户做测试呢?

ChatGPT付费用户体验高级语音模式时遇怪事,正常聊寿司时突然插播广告,连读“A”也会如此。网友猜测是广告插入或“幻觉”,OpenAI技术人员称是幻觉,而国产AI无此问题。

量子位
算法论文7

正确答案 ≠ 正确推理,CoT 或成大模型推理能力停滞的「罪魁祸首」?

研究指出当前大模型推理能力评估关注答案准确性,忽视推理步骤。通过对前沿模型测试发现,2023 - 2024 年大模型推理能力提升停滞,进步靠提示工程,自底向上策略最有效。

AI科技评论
产品应用8

仅需一行代码AI智商飙升成本反降!Claude推出军师模式:最强模型opus只做幕后大脑

Anthropic在Claude平台实装军师策略,让Opus模型后台当军师,轻量级模型当执行者。仅改一行代码就能实现,成本低且能提升智商,已开启Beta测试,还给出使用步骤。

AI寒武纪
新闻资讯7

中美安全公司经营对比及原因分析

国内网络安全上市公司财报显示亏损,而美国同类公司增长与盈利能力强。分析指出,差距源于市场国际化、产品能力和人的因素。国内市场内卷,产品竞争力弱,部分公司决策和态度存在问题。

AI与安全
推荐文章7

第 3 章 Agent 核心功能技术详解

本章以Claude Code及其生态为主参照,介绍现代Agent平台提供类似‘操作系统’机制,包括命令、记忆等。面向熟悉Python与LLM的开发者,按是什么、解决什么问题等展开,还分析了Agent工程核心挑战。

CourseAI
算法论文7

首个人对话视频生成框架MultiTalk,角色有表情还能互动

现有音频驱动人体动画方法聚焦单人,处理音频流能力弱、指令跟随有局限。中山大学提出人对话视频生成新框架MultiTalk,介绍了技术原理,演示效果显示其指令跟随能力强、伪影少。

带你学AI