AGI4S」共找到 2059 篇相关文章

产品应用7

GPT-5 在 Lovable/Vibecode 中氛围编码,附 GLM-4.5 对比 (反向搜索引擎、吵架的俄罗斯方块)

文章展示GPT - 5在网页端、Lovable、Vibecode的测试案例,与GLM - 4.5对比。如GPT - 5在WebDev Arena创纪录,不同版本使用限制不同。还列举多个应用案例,指出GPT - 5有不足,GLM4.5全栈开发表现不错。

AI进修生
算法论文8

Qwen3-VL-Seg 深度解读:当多模态大模型学会"像素级精准手术",仅用0.4%参数碾压8B模型

文章深度解读阿里通义实验室发布的Qwen3-VL-Seg,它解决开放世界指代分割问题,用仅17M参数(占基础模型0.4%)在4B规模超越8B模型。介绍其原理、架构、数据、实验结果,还给出实战代码。

机器学习AI算法工程
新闻资讯8

全球顶尖大模型一夜惨遭血洗!最难测试人类拿满分,AI第一名得0.2%分

全球最难AGI测试ARC - AGI - 3上线,人类满分通关,最强模型Opus 4.6仅得0.2%。测试从静态题变为互动游戏,评分看效率。前沿大模型得分低,非LLM方案表现更好,AI缺乏元认知能力。

新智元
算法论文8

Seedream 4.0大战Nano Banana、GPT-4o?EdiVal-Agent 终结图像编辑评测

在AIGC下一阶段,图像编辑成检验多模态模型关键场景。研究者提出EdiVal - Agent评估框架,能自动化生成指令并多维度评估编辑结果,其评估与人类判断一致性高,还对比了13个模型的多轮编辑表现。

机器之心
产品应用7

一块TFT“屏幕”,如何成为AI4S验证新标准?

Anthropic呼吁放缓AI研究,AI for Science领域上下游能力增长矛盾凸显。TFT天然具备阵列化、高密度等特点,与AI for Materials验证需求匹配。领挚科技基于TFT技术为行业提供验证标准,助力科研成果产业化。

DeepTech深科技
算法论文7

deepseek-V4算法工程技术深入浅出

文章围绕deepseek V4技术报告展开,指出当前大模型训练不充分,介绍了算法层面如混合注意力机制、模型结构优化、优化器等,工程层面如细粒度专家并行、算子内核开发等,以及后训练的范式转变和领域专家网络蒸馏等内容。

Agent的潜意识
产品应用7

对我来说,Claude Code 就是 AGI

作者分享项目中配置 Google Cloud Pub/Sub 服务的经历,以前手动或借助 ChatGPT 操作繁琐,现在用 Claude Code,只需描述问题,它就能自动完成分析、操作、验证等,作者认为其某种程度算 AGI

AGI Hunt
新闻资讯7

GPT-6 Astra:欢迎来到 AGI 时代。

OpenAI 发布 GPT - 6 Astra,总裁称开启 AGI 时代。演示视频展示其强大并行处理能力,跑分有争议,成绩不一。它有诸多成果和安全表现,也有可监控性降低问题,发布过程却状况百出。

AGI Hunt
新闻资讯7

红杉合伙人:2026,AGI已经来了

红杉资本合伙人 Pat Grady、Sonya Huang 联合发文称 AGI 已至,以 Claude Code 为代表的长周期智能体是例证,举例其自主找候选人全程仅 31 分钟。他们给出指数曲线,认为 2026 年是长周期智能体元年,但有人觉得预测太乐观。

机器之心
产品应用8

正式版发布!DeepSeek-V4-Pro-0813

8月13日晚,DeepSeek-V4-Pro-0813正式版发布。此次升级将Agent维度提升至无短板的第一梯队,具备1M+384K长任务能力,接口双兼容,技术创新多。还公布评测对比、价格并发设定,给出实战代码案例与启示。

机器学习AI算法工程