「新功能实现」共找到 6364 篇相关文章

开源动态7

比NotebookLM更实用,基于LLM的AI PPT开源工具,连配套演讲稿都给写好了。

现在很多人用Nano Banana、NotebookLM做PPT,但存在字体、内容契合度等问题。本文推荐基于LLM的开源AI PPT工具LandPPT,它支持多格式文档生成、有深度研究等功能,协议宽松可商用。

开源AI项目落地
新闻资讯7

突发!快手AI掌舵人周国睿即将离职,下一站爆出

多个媒体爆料,快手副总裁、基础大模型及推荐模型负责人周国睿即将离职,目前本人在快手内部系统显示为休假状态。其去向不明,有传加入Meta或TikTok,官方未回应。

新智元
新闻资讯7

国产算力解决方案,如何赋能“AI for Science”?

AI已成驱动科研范式变革的核心力量,“AI for Science”成趋势。中科院陈刚分享AI赋能高能物理见解,还谈及国产算力方案应用表现,22家机构企业发起“科学智能联合攻关行动”。

芯师爷
推荐文章8

Agentic UI:重新定义“好体验”——不是美化按钮,而是让认知负担归零

随着 AI 从“辅助者”变为“执行者”,前端架构需重新定义。传统 UI 以“人是执行主体”为假设,已成为释放 Agent 执行能力的障碍。文章提出 Agentic UI 应成为数字员工的执行工作台,介绍了构建方法及试验成果。

phodal
开源动态8

一文彻底看懂 Google 最新开源 A2UI 协议:如何让 AI Agent “说出UI” ?

本文深入解读Google最新开源的A2UI协议,它让AI Agent学会“说UI的语言”,用安全、声明式格式将UI需求发至前端渲染。文中分析Agent UI面临的挑战,介绍A2UI设计思想、工作流程,还提及它与AG - UI、CopilotKit的关系及未来展望。

AI大模型应用实践
新闻资讯7

大模型可否胸有成竹?探索LLM推理与自信心的关系 | 直播预约

本次全英文直播将探讨大语言模型推理能力扩展瓶颈,介绍以置信度为核心的推理视角,展示“自确定性”指标及应用,还会讨论方法有效性和“基于置信度的推理”意义。

深度学习自然语言处理
开源动态8

分割一切、3D重建一切还不够,Meta开源SAM Audio分割一切声音

Meta 深夜放出音频分割模型 SAM Audio,可通过多模态提示分离任意声音。其核心 PE - AV 推动性能领先,还发布评测模型、基准等,整合进新平台,虽有局限但为音频 AI 带来新可能。

机器之心
新闻资讯7

全网破防,AI「手指难题」翻车逼疯人类!6根手指,暴露Transformer致命缺陷

最近网友被AI「手指难题」逼疯,给AI六指手,它始终无法数对。GPT - 5.2、Nano Banana Pro等均翻车。此问题揭露当前模型思考机械、割裂等缺陷,也凸显Transformer架构弱点。

新智元
推荐文章8

破除AI Agent自主操控风险:万字解读LangGraph“人工干预”机制 ,附零基础实战

随着LLM驱动的Agent从学术走向应用,确保其行为的可靠性、安全性与可控性成关键挑战。文章以LangGraph为例,介绍其人工干预机制的核心原理、四大经典模式及案例实践,助开发者构建可靠、安全的智能代理。

腾讯技术工程
新闻资讯8

美国视频生成老炮儿,入局世界模型

Runway发布首个通用世界模型GWM - 1及一系列变体,包括GWM Worlds、GWM Avatars、GWM Robotics,均基于Gen - 4.5构建。还对Gen - 4.5升级,新增原生音频生成、编辑和多镜头编辑功能。

量子位