「大模型3.0」共找到 10199 篇相关文章

新闻资讯9

Claude有意识了?科学家首次挖出关键拼图,还能伸手改它的念头

本文报道Anthropic最新研究,团队在Claude大模型中发现自发形成的J-space区域,匹配意识研究的全局工作空间理论,人类可直接读取、修改AI未输出的内部想法,揭示了现有AI对齐评测的重大漏洞,为AI意识研究提供了工程化路径。

新智元
新闻资讯7

Alphaist 陈哲对谈蓝驰陈维广:AI 应用的机会在哪里?具身到底怎么投?

Alphaist 创始人陈哲与蓝驰创投管理合伙人陈维广在 AGI Playground 2026 上对谈,探讨 AI 应用机会与具身投资策略。谈到市场热度变化、SOTA 模型与用户需求差距等,也对应用层机会、估值逻辑、具身智能发展发表看法。

Founder Park
新闻资讯7

硅谷顶级团队闭门会,让Agent活下来的共识,95%的AI Agent都死了

旧金山AI技术大会上,企业大佬指出95%的AI Agent在生产环境中失败,活下来的5%符合5个共识,包括做好上下文选择系统、重视安全权限与用户信任、将记忆作为架构决策、多模型编排及合理运用对话与GUI等,还提及被低估的方向。

探索AGI
新闻资讯7

为什么林俊旸会离职? | 甲子光年

3月4日凌晨,阿里Qwen团队技术负责人林俊旸宣布离职,同一天Qwen后训练负责人郁博文也正式离职。阿里刚开源Qwen 3.5小尺寸模型获马斯克点赞,此时核心团队出走引发关注。林俊旸离职或因团队分拆、管理范围缩小及“开源”与“闭源”的矛盾。

甲子光年
新闻资讯7

Claude 小升级就赢了OpenAI 9年“开源神作”?高强度推理直接歇菜、幻觉率高达50%,写作还被Kimi 2吊锤?

OpenAI发布首个开源语言模型系列gpt - oss,包括gpt - oss - 120b和gpt - oss - 20b,可在Hugging Face下载。同期谷歌Deepmind推Genie 3,Anthropic放出Claude Opus 4.1。Claude Opus 4.1编程性能提升,实测编码能力强于gpt - oss。gpt - oss虽有亮点,但幻觉率高、实测效果不佳。

AI前线
新闻资讯7

AI眼镜:又怕小米做,又怕小米不做

过去一年AI眼镜产品密集落地,小米和Rokid跻身全球出货量前三。市场处于“又怕小米做,又怕小米不做”的微妙氛围,大厂试水但未全力投入,给中小厂商留下建立技术壁垒的窗口期,显示技术或成首个分水岭。

远川科技评论
产品应用7

80%代码由Claude合并,Anthropic内部人员点破Agent真相:「Close the Loop」

Anthropic团队研究产品经理Theo演讲指出,Claude已深入其工程流程,超80%代码由它合并。模型角色转变,能力提升,失败率下降。开发者应升级研发战术,如刷新评估基准、精简“脚手架”、闭环设计。

机器之心
推荐文章7

一文搞懂 Coding Agent 和 Harness

文章介绍编码智能体和 Agent harnesses 设计,阐述 LLM、推理模型与 Agent 关系,指出 harness 是让 LLM 在特定任务更好用的关键。还详细讲解 Coding harness 六个核心组件,并对比了 OpenClaw。

特工宇宙
新闻资讯7

Karpathy 教它的 nanochat 数单词里有几个“r”

Andrej Karpathy 教超小型语言模型 nanochat d32 数单词里字母 r 的数量,创建 SpellingBee 合成任务微调模型,虽像填鸭式教学但有效,不过小模型上下文处理能力有限。

AI工程化
开源动态8

4B参数实现理解、推理、生成、编辑一体化!InternVL-U重磅开源

上海人工智能实验室联合多所高校开源多模态一体化模型 InternVL-U,仅 4B 参数,突破现有统一多模态模型瓶颈,在复杂场景超越 14B 级模型,已全面开源,提供推理代码等。

OpenMMLab