「原力灵机」共找到 391 篇相关文章
谷歌Transformer过时了?清华姚班校友等三连击,爆改注意力!
谷歌提出新架构,参数减少40%,训练速度较RNN提升5 - 8倍,某些任务性能超Transformer 7.2%。新架构引入注意力偏向策略,用「保留」取代「遗忘」,还提出Moneta、Yaad、Memora三个新模型,在多任务上表现卓越。
NICE59期 | Agent进入下一篇章!Alita:不靠人工预设,自己造MCP自我进化的AI
这篇论文提出让 Agent 主动创造解决 MCP 的工具实现自我进化,工具可网上检索或自主编写。Alita 做法更通用实效,还提出‘Agent 蒸馏’思想,其生成的 MCP 已用于‘manus’。
从Transformer到GPT-5,听听OpenAI科学家 Lukasz 的“大模型第一性思考”
2017年《Attention Is All You Need》提出Transformer架构,重塑AI版图。其作者“Transformer八子”中,Lukasz Kaiser加入OpenAI,参与GPT-4、GPT-5等研发。他10月将出席大会分享见解,曾预言多模态等趋势已渐成现实。
OpenAI重组GPT-5「灵魂」团队!亚裔女负责人遭调离,罕见自曝AI幻觉祸首
OpenAI进行重磅结构调整,ChatGPT「模型行为」团队并入Post - Training,前负责人Joanne Jang负责新OAI Labs。同时,OpenAI揭秘AI产生「幻觉」的罪魁祸首是「应试」评估体系。
这家公司,“杀死”了他们的 AI 应用
脸谱心智(FaceMind)虽未关停「叠叠社」AI 应用,但开始押注底层世界模型研究。其论文提出 Looped World Models,带来 100× 参数效率提升,强调 AI 可靠更深内部推演获得能力,指出只做应用不够。
全球AI算力大战变天!十万卡算力集群爆表,国产IB真香?
大模型竞赛进入万卡、十万卡时代,网络取代算力成新瓶颈。过去RoCE因成本优势受青睐,但集群规模扩大后运维复杂。IB架构以其稳定性迎来价值重估,国产IB方案突破或改变技术路线选择。
可灵3.0系列模型正式上线:属于每个人的导演时代来临
可灵AI正式全球上线3.0系列模型,覆盖影视级全流程链路。该系列基于All-in-One理念构建,解决了行业一致性等问题,在多方面做了增强,完成从单点生成到专业调度的跃迁,让AI成创作协作者。
领投 Ilya 新公司,13 年净 IRR 33%,Greenoaks 的科技投资哲学
本文编译访谈,展现 Greenoaks 投资哲学。其由 Neil Mehta 创立,13 年净 IRR 达 33%。领投 Ilya 新公司,看重 JDCE 理念,投资聚焦未来 S&P 500 公司,坚持商业规律,不盲目追 AI 热点。
成都中专生,干出3500亿
AI东风下,新易盛靠光模块业务半年暴赚40亿,市值超3500亿。其掌舵者高光荣中专出身,近40岁创业。新易盛产能达历史高峰,机构看多助推估值飙升,同行也在风口起飞。
AI在「赚钱锦标赛」夺冠,比人类还会做生意!躺赚时代要来了?
研究人员提出自动售货机运营模拟环境Vending - Bench,测试大模型智能体管理业务能力。实验显示不同大模型性能方差大,Claude 3.5 Sonnet净资产表现最佳,人类基线在可靠性上表现较好,各模型长周期表现波动大。