多语言编程」共找到 5610 篇相关文章

开源动态7

Angular 官方的智能体 Skills 助力 AI 编程工具生成现代化的 Angular 代码

谷歌 Angular 团队发布 angular/skills 仓库,含两种智能体 Skills,能让 AI 编程智能体编写现代化 Angular 代码。这些 Skills 针对特定工具设计,开发者可安装使用,社区对此看法不一。

InfoQ
开源动态7

AutoDev 架构升级:编程 Agent(CLI/Desktop/Mobile),欢迎一起参与演进

作者介绍 AutoDev 架构升级情况,新架构基于 KMP + Compose 重构,构建编程 Agent,含 CLI、Desktop、Mobile 等版本。还引入 CodeGraph 节省成本,用 Compose 重塑界面,欢迎各方参与演进。

phodal
开源动态8

社区供稿 | VibeVoice实现90分钟、角色播客生成,拓展语音合成新边界

微软亚洲研究院提出全新语音生成模型 VibeVoice,采用 next - token diffusion 机制,能将文字脚本转为最长 90 分钟、最 4 人对话的高质量播客音频,在方面有显著优势,未来潜力大。

Hugging Face
算法论文7

AI如何看懂足球?上海交大团队打造Multi-Agent系统,全面解析“美丽足球”!

现有足球AI研究存在不足,上海交大团队打造Multi - Agent系统。他们构建SoccerWiki知识库、SoccerBench评测基准和SoccerAgent智能体系统,该系统工具协作,实验中碾压GPT - 4,数据和代码将开源。

深度学习自然语言处理
开源动态8

告别 Selenium 痛点!全新升级版 Selenium 自动化框架,斩获10.2K标星!

Selenium 编写 Web 自动化脚本痛点,SeleniumBase 深度封装 Selenium,内置智能等待等功能,解决诸问题。它功能强大,安装使用简单,适用于场景,像“智能助手”让自动化测试变简单。

开源星探
产品应用7

Gemini 3来了,Software 3.0也快了

作者认为Gemini 3是目前最好的模型,编程时前端用Gemini 3,后端用Codex。无编程需求时,它也能助力信息处理。Google推出Generative UI,二者结合让我们接近Software 3.0。

newtype AI
算法论文8

JanusVLN:双重隐式记忆解耦语义与空间,开创视觉语言导航记忆新范式

视觉 - 语言导航(VLN)现有主流方法依赖显式记忆面临挑战,未充分利用3D线索。JanusVLN框架引入双重隐式神经记忆,解耦语义与空间信息,实验验证其性能、效率和泛化能力出色。

AI科技评论
算法论文8

Google研究发现:Multi-Agent的核心竟然是Prompt设计!

Google和剑桥大学研究智能体系统,发现提示设计影响大,有效拓扑结构占比小。提出Mass框架分三阶段优化,实验用Gemini 1.5 Pro和Flash模型,对比种方法,在任务上性能显著提升。

PaperAgent
开源动态8

Github 8.7K star 厉害!!! 一款轻量好用的web自动化项目!

Nanobrowser是开源Chrome扩展工具,专注AI驱动的网页自动化。免费且本地运行,保护隐私,支持主流大模型。有智能体协同等特点,还介绍了安装配置方法,是高效安全的网页自动化之选。

开源先锋
产品应用7

AI开始学会合作?!实测4大Agent体=10个打工人

Agent热潮进入智能体时代,款产品涌现。鲸哥测评了它们在商业计划、运营设计等四大场景表现,总结各产品亮点与不足,指出Agent正推动大模型向“协作式智能群体”演进。

鲸选AI