商汤悟能」共找到 5075 篇相关文章

算法论文8

“最强具身VLA大模型”,究竟强在哪儿?

机器人基础模型π*0.6刷屏,让机器人高效完成多项任务。它引入Recap学习法,突破传统模仿模式。其核心方法RECAP让VLA用奖励反馈和人类介入训练,还从异构数据学习,实现自我进化。

量子位
开源动态7

Sora 模糊视频有救了!强大的免费开源AI视频处理工具!硬件要求低!

Video2X-QT6是免费开源AI视频处理工具,支持视频超清放大、补帧,兼容CPU和GPU,低配置电脑也用。6.0.0版本用C/C++重写,速度快、跨平台,还处理图片。介绍了不同系统安装方法等。

GitHubStore
新闻资讯8

7 小时连续重构不掉线!一骑绝尘的Claude 终于遇到对手:Greg Brockman亲自解读AI编程重大突破

9月16日,OpenAI推出新模型GPT-5-Codex,专为AI辅助编程工具设计。它在代理编码基准测试中表现佳,形成了覆盖各种需求的交互界面,还具有更优的后训练特性,连续工作7小时完成复杂重构。

InfoQ
开源动态7

Wan2.2-Animate又火了,5分钟让抠脚大汉秒变高冷女神。

阿里开源模型Wan2.2 Animate又火了,用照片和视频就生成换脸视频,表情动作复刻佳。它上限高,还变声,可用于舞蹈视频、影视二创等,但手指易崩坏。模型开源,有积极意义也有风险。

数字生命卡兹克
算法论文8

AI安全得查祖宗三代?Anthropic登Nature揭秘大模型潜意识传染

Anthropic论文登上Nature,揭示AI模型仅通过纯数字序列就继承另一模型的危险偏好。研究表明,即使删掉敏感词,隐性信号仍传递,且代码和推理链也是传染通道,这对AI安全评估提出新挑战。

新智元
产品应用8

真碾压Sora了!谷歌Veo 3首次实现音画同步,视频模型直接「开口说话」

谷歌正式发布Veo 3,它生成高质量视频,还理解原始像素,自动生成与画面同步的对话、多种音效。得益于DeepMind的V2A底层技术,其音画合成功领先。虽有时长和使用门槛限制,但已足够震撼。

机器之心
新闻资讯7

给龙虾定MBTI、发工牌,还让龙虾偷技…打工人得适应新环境了

AI圈掀起“养龙虾”热潮,智谱、腾讯纷纷发布相关产品。极客和开发者对龙虾进行实测,它不仅用于打造赛博宠物、线上办公室,还完成视频剪辑、教辅、营销等工作。同时,Agent框架让大模型进入业务线,飞书成合适的工作台。

量子位
开源动态8

7×24h「全职AI员工」爆火硅谷!退休码农让Mac mini一夜卖爆

由Peter Steinberger开发的开源项目Clawdbot爆火硅谷,它可在Mac mini上运行,调用多种模型,还通过聊天APP对话。它解决了主流大模型记忆力痛点,重塑了个人AI超级助手定义,还带火了Mac mini。

新智元
产品应用8

秘塔AI也终于悄悄上线了DeepResearch。

秘塔AI搜索上线新功DeepResearch,作者测试后评价颇高。它有可视化界面,展示思考执行过程,打破AI黑盒。输出报告质量好、精准度高,还可生成互动网页,且免费额度多,虽有小问题但仍值得肯定。

数字生命卡兹克
产品应用8

豆包 Seed 2.0 Lite升级:给 Agent 装上眼睛和耳朵

近期模型发布竞争激烈,作者做视频字幕常遇识别错误,因语音识别工具缺上下文。字节方舟的豆包 Seed 2.0 Lite 升级后听,还可结合上下文准确输出字幕,成本降 20%,也理解视频,为工作流补全感知。

花叔