交互方式」共找到 1345 篇相关文章

新闻资讯7

Shopify CEO考虑禁用Claude Code,因其不兼容AGENTS.md

Shopify CEO Tobi Lütke 考虑在 Shopify 禁用 Claude Code,因其坚持读取`CLAUDE.md`,与团队常用的`AGENTS.md`等不兼容,可能使开发者获不同项目规则。开发者社区给出解决办法,Lütke仍担忧大规模维护难题,Claude Code 团队称会跟进。

机器之心
算法论文8

从「片段生成」到「长视频漫游」:OmniRoam探索轨迹可控的长视频生成新范式

在生成式视频发展中,长时序视频生成面临挑战。研究者提出 OmniRoam 新方法,通过全景表示和分阶段生成框架,提升视频时空一致性,还构建数据评测体系,实验表现优,有效率和 3D 应用潜力。

机器之心
推荐文章7

第 4 章 Agent 开发实战

本章面向理解大模型、会 Python 但未系统搭建过 Agent 的工程师,采用「概念 → 最小示例 → 可运行项目」结构,介绍 Agent 开发实战,涵盖 LCEL 拼装、工具暴露等内容,还说明了开发环境搭建方法。

CourseAI
开源动态7

mem9:让微信里的龙虾不再失忆

文章介绍了 mem9 这一给 AI Agent 用的持久化记忆基础设施。它由 TiDB 团队打造,能解决 AI 失忆问题,实现记忆云端存储、无缝迁移,有两段式提取、混合搜索等功能,还能筛出重要记忆。

AGI Hunt
7

谷歌Gemini最强性价比模型发布,1块8读完3本三体

谷歌推出Gemini 3.1 Flash-Lite,号称性价比最高的Gemini 3系列模型,每百万输入token仅0.25美元,读完3本《三体》只需1.8元。性能表现佳,还支持可调思考层级。两小时后ChatGPT推出GPT - 5.3 Instant回应。

量子位
开源动态8

多模态Deep Research,终于有了「可核验」的评测标准

俄亥俄州立大学与 Amazon Science 等联合发布 MMDR - Bench,将多模态 Deep Research 评估拉到可核验标准。它含 140 个专家任务,覆盖 19 领域,把评估拆成 3 段管线、12 指标,强调过程证据链。

机器之心
开源动态7

纯本地隐私绝佳,没网也能翻,30+语言支持!

日常常用翻译工具依赖云端,有隐私风险。开源离线翻译项目`Argos Translate`,基于Python开发,支持多语言互译,有多种使用形式。虽翻译精度略逊,但隐私性好、可自由部署,适合有安全需求的用户。

开源先锋
产品应用8

可灵3.0系列模型正式上线:属于每个人的导演时代来临

可灵AI正式全球上线3.0系列模型,覆盖影视级全流程链路。该系列基于All-in-One理念构建,解决了行业一致性等问题,在多方面做了增强,完成从单点生成到专业调度的跃迁,让AI成创作协作者。

AI科技评论
产品应用8

当 GPU 成为主角:解锁 AI 集群中那 85% 的闲置 CPU 算力

全球AI算力规模增长,GPU成主角,但GPU满负荷运转时CPU利用率低,传统调度机制无法保障优先级,造成资源浪费。TencentOS如意(RUE)的在离线混部技术改造Linux内核调度体系,高效释放算力。

InfoQ
开源动态8

港大开源 Paper2Slides,一条命令,把论文变成专业幻灯片!

在AI辅助办公赛道,PPT生成一直是竞争热点,但存在好看不好用、好用不准确的问题。港大开源的Paper2Slides项目,能一条命令把论文转成专业幻灯片,还能做海报,解决了AI幻觉问题。

开源星探