全栈能力」共找到 4714 篇相关文章

开源动态8

LLaVA-OneVision-1.5流程开源,8B模型预训练只需4天、1.6万美元

灵感实验室团队联合 LMMs - Lab 推出 LLaVA - OneVision - 1.5,流程开源。其 8B 模型预训练 4 天、成本 1.6 万美元,在多模态基准上性能优,还公开数据构建与训练策略等细节,复现简单。

机器之心
开源动态8

Github 3.6k star,爆火开源「小红书 MCP」:一键登录、图文发布、搜索、评论搞定

`xiaohongshu-mcp`把浏览器手工步骤封装成可编排工具,以Go编写,能在无头/有界面模式间切换。它解决小红书运营多痛点,如登录不稳、发帖链路长等,覆盖登录、发帖等链路,适配多客户端,值得收藏上手。

小华同学ai
产品应用8

上海AI实验室发布 Intern Lumina U2:离散扩散建模,让模型既能“看懂”也能“生成”

上海人工智能实验室发布新一代多模态统一模型 Intern Lumina U2,基于离散扩散建模路线,支持多任务,适配两大硬件生态,在昇腾千卡级集群训练效率提升 1.85 倍,性能优异且将开放资源。

OpenMMLab
新闻资讯8

刚刚,球首个AI科学家登上Nature!包揽提出idea到写论文流程,已通过人类盲审

历经一年半研发,Sakana AI联合多高校打造的AI科学家系统登上Nature杂志。该系统能自主完成科研流程,代码和论文已开源。还介绍了自动审稿人、缩放定律,也指出其局限,引发伦理探讨。

AI寒武纪
产品应用7

不吹不黑,GPT-5代码能力究竟怎么样?跟 Gemini 和 Claude 的对比测试给你答案

作者测试了 GPT-5 的代码能力,并与 Gemini 和 Claude 对比。在不同代码任务中,各模型表现不同。如在生成网页任务里,GPT-5 部分结果不错,但受 32K 上下文限制,长文本处理不如 Gemini,硬实力也不如 Claude。

歸藏的AI工具箱
开源动态8

30.9K Star牛啊!!再见了PD,不越狱也能装,支持几十种系统,苹果设备通用!

在苹果生态运行其他系统,Parallels Desktop 收费且移动设备难装。开源工具 UTM 免费,基于 QEMU 构建,支持多架构和系统,操作界面简洁,外围设备支持强,苹果设备通用。

开源先锋
推荐文章8

人类或将沦为“NPC”!智谱创始人唐杰最新研判:LLM正从攻克长程任务到自主进化

智谱创始人唐杰认为今年LLM技术突破点在长程任务,能在智能体环境交互完成复杂任务。随能力提升,将迈向‘无人公司’时代,人类或成‘NPC’。后续要攻克记忆、学习等技术,实现自我进化,重塑产业。

AI寒武纪
产品应用7

1周半写64个PR、完成30%项目重构:一家成熟SaaS公司把Agent塞进研发流程后

Calendly作为成熟SaaS公司,分享Agentic Engineering实践,让Agent嵌入研发流程。如一周半生成64个PR,完成30%项目重构。还探讨了瓶颈转移、对工程师的影响等,强调判断力和规则的重要性。

AI前线
开源动态8

刚刚,面壁小钢炮开源进阶版「Her」,9B模型居然有了「活人感」

2月4日,面壁开源双工模态大模型MiniCPM - o 4.5,在多方面达SOTA水平。它能边看边听边说,实现自主交互。实测中表现如真人,其架构和机制有创新,还适合端侧部署,或开启人机交互新时代。

机器之心
产品应用8

太炸裂了!网实测Nano Banana Pro,网友:这模型里到底装了什么鬼东西!

谷歌Nano Banana Pro出世引发网关注,它又名Gemini 3 Pro Image,整合多模态理解能力与知识库。普通用户可在Gemini应用免费体验,实测显示其实力强悍,还在网友手中玩出花,谷歌CEO也站台。

量子位