新全栈」共找到 5181 篇相关文章

产品应用8

真正的一句话修图:Gemini 用香蕉模型给出了图像生成的分水岭

Google模型Gemini 2.5 Flash Image可在AI Studio体验。它有多图融合、角色一致性等能力,能实现自然语言编辑图像,速度快、价格低、API可用,虽有中文体验等问题,但有望让AI视觉工具进入工程化时代。

MacTalk
推荐文章7

拒绝强行AIGC!| 一种安实用、准确率高的Text2Sql方案

在金融、医疗等对精确性、透明度和安性要求高的领域,完依赖大模型NL - to - SQL能力易出错。本文提出基于函数调用LLM的范式,将LLM能力聚焦于调用预定义功能函数,提升了数据检索的准确性、透明度和可维护性。

AINLPer
产品应用8

5000万用户、5000万美金ARR,球第一AI创作消费平台要做AI时代Roblox

在AI大模型军备竞赛中,用户侧出现‘智能过剩’。SeaArt成立两年半成球访问量第一的AI内容创作社区,其2.0版本SeaVerse实现流程自动化。该公司不陷‘卖模型’陷阱,商业模式独特,有望成AI时代民级内容平台。

机器之心
开源动态8

登顶Hugging Face GAIA球榜首!中兴超级智能体终结「AI黑盒」时代

中兴通讯研发的超级智能体Co - Sight 2.0登顶Hugging Face GAIA球权威榜单。它解决传统智能体痛点,有链路可信计算框架等创架构,其智能体工厂和开放标准助力构建生态,展现了智能体产业落地潜力。

新智元
开源动态7

凌晨,Qwen又更了,3090就能跑,3B激活媲美GPT-4o

Qwen凌晨更,Qwen3 - 30B - A3B有版本Qwen3 - 30B - A3B - Instruct - 2507。仅激活3B参数,实力媲美谷歌Gemini 2.5 - Flash和OpenAI的GPT - 4o,在多项测试中提升显著,已在魔搭社区等平台开源。

机器之心
算法论文8

挖掘注意力中的运动线索:无需训练,解锁4D场景重建能力

香港科技大学(广州)与地平线团队提出VGGT4D,通过分析VGGT内部机制,利用注意力层运动线索,提出无需训练框架,在动态物体分割等任务表现优异,为低成本4D重建提供思路。

量子位
新闻资讯8

训练数据量降低1万倍,谷歌提出超高质量数据主动学习方法

将大模型应用于特定领域需数据微调,但筛选高保真训练数据难度大、成本高。谷歌提出主动学习筛选流程,能将训练数据规模降1万倍,还提升模型与人类专家一致性。经实验验证,该方法效果显著。

AIGC开放社区
新闻资讯8

当人们怀念 GPT-4o,他们在「怀念」什么?

8月8日OpenAI下架GPT - 4o强制用GPT - 5,用户不满模型冷漠,发起“拯救4o”运动。OpenAI被迫恢复上架4o,但用户信任动摇。此风波凸显AI情绪价值重要,也给AI公司产品迭代敲响警钟。

Founder Park
7

刚刚,GPT-5内测抢先泄露!推理强到离谱,智商被曝140超越人类天才

周五凌晨,GPT-5、GPT-5 Mini和GPT-5 Nano将推出,网可通过API和ChatGPT访问。GPT-5基准测试结果疯传,实测表现出色。同时,OpenAI发布开放权重模型GPT-oss,登顶开源王座,外媒分析其豪赌开源原因。

新智元
新闻资讯7

刚刚,MOSS孙天祥创业,直播AI4AI大规模科研

创业公司Analemma将球公开直播部署端到端AI研究系统FARS,目标是自动完成100篇论文,直播预计持续一个月。FARS是无人类干预、纯AI驱动的系统,能完成科研流程。其创始人是孙天祥,团队年轻且获数千万美元融资。

机器之心