登录 注册 退出
博客 AI资讯+
热门搜索: 2024 坍塌之后

标签:token

共 8 篇文章
Runway推出Media Router:自动切换AI模型帮你省Token,创意验证到成片一条龙搞定 AI

Runway推出Media Router:自动切换AI模型帮你省Token,创意验证到成片一条龙搞定

7月23日,Runway发布Media Router智能路由系统,可根据使用场景自动切换AI模型,在创意验证、成片等不同阶段匹配最优模型。已接入Seedance......

普思AI资讯 4星期前 14 阅读
大模型接管5G基站选址,中国电信把建网效率拉高50% AI

大模型接管5G基站选址,中国电信把建网效率拉高50%

7月21日,中国电信宣布完成5G无线网络规划大模型现网试点。该模型将规划效率提升50%,方案准确率达75%以上,实现设计方案自动输出。核心技术为“双孪生大模型协......

普思AI资讯 1个月前 10 阅读
谷歌秘密研发Frozen v2芯片:把Gemini“刻”进硅片,每瓦Token翻10倍 AI

谷歌秘密研发Frozen v2芯片:把Gemini“刻”进硅片,每瓦Token翻10倍

谷歌秘密研发Frozen v2芯片,将Gemini模型架构直接固化于硅片,单位功耗Token处理量达现有TPU的6至10倍,最早2028年部署。独立于TPU产品......

普思AI资讯 1个月前 18 阅读
百度沈抖:每月给员工发1000元额度随便用大模型,强制推AI办公难见效 AI

百度沈抖:每月给员工发1000元额度随便用大模型,强制推AI办公难见效

百度集团执行副总裁沈抖表示,强制推行AI办公难落地见效,百度以正向引导为主,为每位员工每月发放1000元大模型使用额度,不绑定考核。2026年Q1百度AI收入占......

普思 1个月前 17 阅读
小红书联手北大上交提出HYPIC,混合注意力大模型首token延迟平均降3.25倍 AI

小红书联手北大上交提出HYPIC,混合注意力大模型首token延迟平均降3.25倍

小红书联合北大、上交提出HYPIC,首个在混合注意力大模型上实现位置无关缓存的服务系统。针对线性层缓存转移算子、全注意力层采用缝合窗口、系统级并行加速冷请求,三......

普思 1个月前 13 阅读