声画同出」共找到 1124 篇相关文章

开源动态7

Vibe Coding 何必只在桌面 IDE,多端智能体协的思考与设计

依托下一代开源 AutoDev 架构,在 AutoDev 多平台预览版中实现了 Server 与 Android 的架构一体化与协。Vibe Coding 可按自然语言提示生成代码,现阶段能完成 80% 功能,但跨越剩下 20% 挑战需团队工程化落地。

phodal
算法论文8

Depth Anything再新作!浙大&港大品:零样本,优化任意深度图

浙江大学与港大团队推「Prior Depth Anything」,融合深度传感器数据与AI深度图,一键补洞、降噪、提分辨率。无需额外训练,可提升3D模型深度质量,零样本刷新多项深度处理纪录。

新智元
算法论文8

谷歌DeepMind「粪坑淘金」全新方法,暗网毒数据也能训善良模型

谷歌DeepMind研究团队发表论文提生成式数据精炼(GDR)方法,不直接生成新数据,而是用大模型净化原始数据,保留有用信息。该方法能解决数据枯竭、隐私等问题,实验显示效果良好。

新智元
新闻资讯8

刚刚,英伟达祭下一代GPU!狂飙百万token巨兽,投1亿爆赚50亿

昨天,英伟达发布专为海量上下文AI打造的CUDA GPU——Rubin CPX,将大模型推理带入「百万Token时代」。它性能强大,能带来高回报,可重写推理经济,还将得到英伟达全栈AI生态支持,预计2026年底可用。

新智元
推荐文章8

Cursor要凉?我扒33个隐藏技巧,把Claude Code调教成完全体!

作者分享Claude Code实用技巧,指其默认状态有问题,如犯低级错误、无回滚功能。介绍基础设置、项目规则、用Hooks实现自动化等内容,能大幅提升其使用体验和生产力。

探索AGI
产品应用7

GPT-5超越人类医生!推理能力比专家高24%,理解力强29%

最新研究显示,GPT - 5在医疗领域处理多模态信息能力色,在多模态测试中推理和理解得分比GPT - 4o分别提高近30%和36%,比人类医生还高。其能力提升源于端到端多模态架构,但现实应用还需更多实战考验。

量子位
算法论文8

ICML 2025 | 大模型能在信息不完备的情况下问正确的问题吗?

当前大语言模型推理研究多聚焦被动推理,主动推理研究少,制约其在现实场景应用。为此提 AR - Bench 基准评估大模型主动推理能力,实验显示大模型主动推理能力严重不足,并指后续拓展方向。

机器之心
产品应用7

Google发布“法律版Gemini”:能审合,也能连接律所核心数据

8月25日,Google Cloud发布Gemini Enterprise for Legal面向律所和企业法务团队开放预览。它想解决让模型进入律所现有工作系统,不打乱权限等规则的问题,通过MCP连接系统并继承权限,还组织各方合作。

AIGC开放社区
新闻资讯7

Sonnet 5 翻车!性能价差最高 56倍,海外巨头为何复刻不 DeepSeek?

Anthropic发布Claude Sonnet 5,官方称补足了Agent能力,价格优惠,但开发者反应不佳。Sonnet 5因tokenizer换代,实际使用成本更高,且比类模型贵。与之相比,DeepSeek V4 Pro便宜很多,其靠技术实现低价,海外厂商难以复刻。

鲸选AI
产品应用7

大模型已经够聪明了,为什么 95% 的 AI 项目还是跑不 ROI?

2026年AI落地现悖论,模型能力强但多数项目难有ROI,原因是数据未准备好。腾讯云在AI产业应用大会宣布升级全栈数据平台,推DataBuddy,可在多场景实现对话即交付,解决数据问题助力AI落地。

InfoQ