3D物体操作」共找到 2560 篇相关文章

算法论文7

Claude Code新功能Auto Mode能否替代人工审核?首个压力测试来了

随着AI coding agent走向“直接执行开发操作”,Anthropic为Claude Code推出Auto Mode。香港科技大学与ETH Zurich研究团队对其进行首个系统压力测试,发现Auto Mode端到端误放行率达81.0%,部分危险操作绕过审核。

机器之心
算法论文7

代码榜刷满分,AI科研却撞墙?140道真实研究题撕开「自进化」真相

新工作MLS - Bench覆盖12领域、140个研究任务,评测前沿模型科研能力。虽模型工程执行强,但科学发现能力弱,当前仍难提出有效算法创新。其评测已纳入Kimi K3和Qwen3.8 - Max官方发版表。

新智元
新闻资讯7

老外傻眼!明用英文提问,DeepSeek依然坚持中文思考

DeepSeek-V3.2和DeepSeek-V3.2-Speciale推理能力显著提升,海外研究者用英文提问,它却用中文思考。评论有两种观点,相关论文显示中文省token但非最有效,大模型选思考语言并非只看效率。

机器之心
算法论文7

《TAML》好文推荐 | 来自中国科学院力学研究所张磊博士 评估大语言模型在计算流体力学领域的知识利用、学习与创造

研究聚焦评估推理型(DeepSeek R1和OpenAI o3 - mini - high)与非推理型(DeepSeek V3和ChatGPT 4o)大语言模型在计算流体力学领域知识利用、学习与创造能力。通过三类基准问题评估,结果有差异。

力学与人工智能
6

苹果App Store应用商店上传与APP上传流程必看(基础篇)

App 若想成功出现在Store中,开发者还需要经过上传操作和苹果公司严格的审核。同时,App当上架至App

6

苹果应用商店App Store推荐和惩罚机制

App 若想成功出现在Store中,开发者还需要经过上传操作和苹果公司严格的审核。同时,App当上架至App

新闻资讯8

让龙虾看懂屏幕!谷歌多模态新成果,文本图像视频音频进同一空间

谷歌发布首个原生多模态嵌入模型Gemini Embedding 2,将文本、图像、视频、音频和文档映射进同一嵌入空间,支持多模态混合输入,为AI Agent“看懂”世界提供关键基础,已展开公测。

量子位
开源动态8

所有AI工具共享记忆!MCP协议杀疯了:100%本地运行,Cursor、Claude都能用

当下多数AI工具各自独立运行,会话结束上下文即消失。OpenMemory MCP能解决AI工具记忆痛点,实现不同工具间共享上下文信息,支持100%本地运行,有跨平台支持等丰富功能。

量子位
产品应用7

Gemini桌面客户端终于上线:直接读取屏幕上下文,帮你解读一切!

谷歌推出Gemini的macOS原生客户端,支持全局快捷键拉起和窗口共享。它能突破浏览器限制,基于屏幕内容提供反馈,但目前离真正的桌面助手还有差距,后续有望补齐能力。

新智元
产品应用7

剪辑 Agent 字幕升级:99% 正确率的字幕,一条指令直接推进剪映

作者成峰重做剪辑 Agent 字幕功能,结合 capcut - mate 项目,接入语音识别服务等优化流程。字幕准确率最高达 99%,还介绍了 5 步使用方法,解决非技术用户使用门槛问题。

AI产品自由