「计算机智能体」共找到 5511 篇相关文章
猛涨25k star!一键检测你的电脑能跑哪些大模型!
最近 Github 出现工具 `LLMFit`,用 Rust 编写,能自动检测硬件配置,判断大模型能否流畅运行,推荐最优量化版本和运行模式。有一键硬件检测等特性,安装使用方便,降低本地部署门槛。
别再迷信大模型!吴恩达亲授AI秘籍:小模型+边缘计算=财富密码
吴恩达指出,AI创业真机遇不在大模型,而在智能体。智能体市场潜力大,创业者可发挥其专业化优势。还建议忽略AGI,用AI解决日常问题,关注小模型边缘计算、军民两用场景,构建可信AI应用。
AI版盗梦空间?Claude竟能察觉到自己被注入概念了
Anthropic最新研究发现LLM有内省迹象,Claude能察觉概念注入。研究用概念注入测试,虽模型内省能力有限且不可靠,但能力强的Claude Opus 4和4.1表现好,未来内省或更复杂。
原来Scaling Law还能被优化?Meta这招省token又提效
2017年《Attention Is All You Need》提出的Transformer是主流语言模型基础范式。Meta新论文提出旋转不变型三线性注意力机制,证明其表现能改变Scaling Law系数,还证实2 - simplicial Transformer在有限token预算下更优。
重塑注意力机制:GTA登场,KV缓存缩减70%、计算量削减62.5%
GTA由多所高校联合研发,提出大模型框架,解决传统多头注意力机制弊端。通过分组共享注意力矩阵和压缩潜在值表示,削减计算量、缩减KV缓存,实验验证其性能优、效率高,虽有局限但前景好。
这种“半光半物质”粒子,有望补上AI光计算最后一块拼图
宾大物理学家 Bo Zhen 团队造出激子-极化激元,用约 4 飞焦能量完成光信号全光开关切换。光子计算在非线性环节依赖电子器件,该成果有望补上缺失环节,但距商用还有关卡。
刚刚,谷歌发布机器人最新「大脑」模型!思考能力SOTA,还能「跨物种」学习
谷歌旗下DeepMind发布Gemini Robotics 1.5系列模型,包括Gemini Robotics 1.5和Gemini Robotics - ER 1.5,能让机器人学会‘思考’,还可跨具身形态学习技能,有望开启通用机器人新时代。
OpenAI奥特曼:能被ChatGPT消灭的工作不是真正的工作
OpenAI奥特曼在访谈中分享对AI与工作的思考,还谈及GPT - 6进展、ChatGPT发展、AGI设想等。他认为能被ChatGPT消灭的工作不是真正的工作,还探讨了AI带来的变革和挑战。
LLM 仅靠自身就能增强推理?SePT 给出简洁在线自训练范式
多数推理后训练方法依赖外部信号,SePT仅用模型自身生成的答案自训练,能提升推理能力,数学推理任务准确率升10个点。它核心简洁,设计关键是温度解耦等,不损模型通用能力,代码易迁移复现。
苹果脑机接口技术曝光:用思想操作 iPhone,AI 直接能代其“发声”?
苹果宣布与脑机接口公司 Synchron 合作,开发能读取大脑信号的植入式设备,可将信号转化为操作指令。该技术尚处早期,对残障人士是重大进展,结合 AI 潜力巨大。