多模态视频生成」共找到 3315 篇相关文章

开源动态8

10 万 Star 的反常识:AI 写代码的瓶颈从来不是代码本身

GitHub上的Superpowers开源项目,半年攒10.9万Star。它是AI编程工具的工作流操作系统,让AI像工程师工作,有面试需求、细化计划等流程,内置14个技能,安装简单,理念超前但也有局限。

CourseAI
产品应用7

求码10天,我终于过上了在微信上使唤🦞的日子

腾讯鹅虾产品QClaw升级,将微信入口变为小程序,支持传文件,上线灵感广场。作者求码10天体验它,测试其在微信和电脑端操作能力,肯定便捷性,也指出执行流程不透明等问题。

量子位
新闻资讯7

“龙虾”时代,大模型公司的好日子来了

3月10日,MiniMax港股收涨,市值超百度。OpenClaw爆火,其创始人转发评测榜单,使MiniMax-M2.1排名突出。OpenClaw是智能体构建框架,为大模型公司带来盈利转机,撬开收入天花板,引发各方关注。

远川科技评论
产品应用8

小鹏加速冲向L4终局:对VLA架构「动刀」成关键一环

在辅助驾驶领域,端到端的VLA方法虽有效果,但面临中间层语言难以准确表达物理世界细节的问题。小鹏汽车去掉“语言转译”环节,推出第二代VLA,有跨代级驾驶体验,背后是底层技术架构重构。

机器之心
新闻资讯7

编程奇点逼近,程序员斩杀线就在眼前!软件版YouTube时刻在发生

新智元报道,软件开发正迎来「YouTube时刻」,AI工具如Cursor、Claude Code等让编程变简单。A16z投资人预言App创建速率或飙升10倍,软件边际成本趋近零,人人可成开发者,不过程序员也面临被AI替代风险。

新智元
产品应用8

科学家的超级合伙人来也!星河启智「大圣」让高能动性AI「入局」真实科研

星河启智平台推出超级科研合伙人「大圣」,它构建了多模态科学基础模型等智能体协作研发能力,具备认知、行动、记忆、验证四大能力,且引入可信安全机制,推动科研生产关系重排。

机器之心
算法论文8

ICLR 2026 | 7B小模型干翻GPT-5?AdaResoner实现Agentic Vision的主动「视觉工具思考」

文章介绍了AdaResoner模型,它学会‘何时用工具’,在拼图推理上击败GPT - 5。Google为Gemini 3 Flash引入‘Agentic Vision’,与AdaResoner殊途同归。AdaResoner有独特训练方法,提升小模型性能。

机器之心
产品应用8

刚刚,Anthropic分享了构建Skills的最佳实践

Anthropic获300亿美元融资,估值达3800亿美元,发布《The Complete Guide to Building Skills for Claude》指南。介绍Claude Skills本质、与MCP关系、应用场景、技术实现、设计模式及测试迭代方法。

PaperAgent
产品应用8

我给 Claude Code 加装了 MiniMax M2.5:它像“法拉利”,但更像一台工作机

作者给 Claude Code 加装 MiniMax M2.5 模型,测试其编程、上下文记忆等能力。M2.5 在多方面表现出色,能高效完成各类开发任务,还具备良好的中文处理能力,性价比高。

MacTalk
新闻资讯8

Open Responses 规范实现智能体式 LLM 工作流的统一

OpenAI发布Open Responses开放规范,获Hugging Face等支持,为智能体式AI工作流制定统一标准,减少API碎片化,支持多模态输入等,引发行业对厂商锁定和生态成熟度的讨论。

InfoQ