移动 App 开发」共找到 1914 篇相关文章

开源动态8

DeepEval:LLM 应用评测不再玄学,让大模型评测像写单元测试一样简单

在大模型应用开发中,科学、自动化评测 LLM 输出质量是难题,人工评测效率低。DeepEval 是 Confident AI 团队开源的 LLM 评测框架,能用极简代码让评测像写 pytest 一样自然,内置多种评测指标,支持批量评测等。

AI工程化
开源动态8

微软开源浏览器Agent,可实时跟踪、控制智能体,超4000颗星

微软在官网开源用于浏览器网络任务的Agent——Magentic - UI,基于Magentic - One开发,支持人机协同。GAIA测试显示其能提升任务完成率和准确率。它以人为本,有独特机制,框架含多阶段,在Github超4000颗星,支持MIT许可证商用。

AIGC开放社区
新闻资讯8

你还在关注大模型排名?这家公司已在全球收割AI红利,做“真正能交付结果的”Super Agents

文章借昆仑万维财报,探讨AI商业化进程。该公司战略重视AIGC,有全面业务场景。其发布的天工超级智能体解决行业痛点,上线APP拓展办公场景。财报显示营收增长,AI业务成引擎,为行业提供借鉴。

量子位
推荐文章7

“由 AI 生成的代码,从诞生那一刻起就是「遗留代码」!”

如今生成式AI融入软件开发,AI生成的代码一诞生或被视为“遗留代码”。它缺乏上下文记忆和维护连续性,虽有开发者尝试弥补,但代码未来或多靠提示生成。文章观点在Hacker News引发讨论。

AI科技大本营
新闻资讯8

Gemini 2.5 Pro强势更新并霸榜,Claude 3.7首次遭遇全方位碾压!

Google DeepMind推出的Gemini 2.5 Pro在LMArena各大排行榜全面登顶,实现文本、视觉、Web开发全方位霸榜,编码能力也大幅升级。虽有质疑,但短期内难有对手,还引发对Google I/O大会更多惊喜的期待。

AGI Hunt
开源动态8

浙大开源PhyEdit:单图编辑+精准3D物体操作 | ACM MM'26

浙江大学ReLER团队开源的PhyEdit,用3D foundation model明确目标几何,让DiT图像编辑器负责最终渲染。单张图片里物体能移动并形成连续状态,在多项指标表现出色,还具备多种能力,已被ACM MM 2026接收。

新智元
新闻资讯7

御三家都在押注的 Loops,代码怎么还是垃圾?

在AIE World's Fair大会的《伟大的Loops》辩论赛上,正反方就Loops展开激烈交锋。正方认为Loops配得上热度,是迈向软件工厂关键一步;反方则指出其炒作与实际效果差距大,当前做法有误。双方还探讨了安全性、可用性、开销等问题。

AI前线
开源动态8

白嫖10余家AI服务,一个接口全搞定,爽了!

现在主流AI厂商虽有免费额度,但使用起来接口、SDK、限流规则等差异大,适配麻烦。freellmapi项目将Google Gemini等十几家AI平台免费Tier聚合,对外一个接口,自动调度、切换和限速,适合做AI原型开发等。

开源先锋
开源动态8

14.8K Star!这个开源 Skill,一句话就能做出大厂级设计!

Anthropic 发布的 Claude Design 虽能在对话框生成网页,但需手动操作。有人据此开发了开源项目 Huashu Design,可在 agent 里打一句话,3 到 30 分钟就能拿到能交付的设计,还介绍了其功能、核心规则等。

开源星探
新闻资讯7

外行瞎写的Vibe Coding,都能并入Agent 工程了:最吓人的是,我们“摆烂”有正当理由了

本文编译了软件专家 Simon Willison 在播客的访谈内容。他指出 Vibe Coding 与 Agent 工程正走向融合,AI 写代码渐趋可靠,人类审查成开发瓶颈,还探讨了 AI 对编程的影响、算力成本博弈等问题。

InfoQ