-
腾讯混元开源HiLS-Attention:稀疏注意力首次在数学上被做对,外推512倍
4M上下文免训外推,512K下prefill快13.5倍、decode快15.7倍,部分长上下文检索任务效果甚至超越全注意力。存量模型仅需续训50B token即可切换,短任务不掉点。
资讯 2026-07-21
-
xAI发布Grok 4.5:编程能力登顶全球,88分创评测新高
能力,在真实工程任务中表现突出,获工程师“真正有用”评价。Grok 4.5在速度、效率和成本上具优势,token效率提升约一倍,推理速度高达80 TPS,API价格比对手便宜60%以上。xAI宣布激进
资讯 2026-07-10
-
应对异构芯片部署下的 AI 挑战,F5 助企业推理服务更快、更省、更承压
随着人工智能(AI)大模型及智能体应用在企业端的全面落地,产业竞争的核心维度正发生深刻演变。据统计,截至 2026 年 3 月,中国日均词元(Token)调用量已超过 140 万亿,相比 2024
动态 2026-07-10
-
联想问天超节点解决方案重磅发布,四大能力重塑AI时代算力基础设施
联想问天超节点解决方案的推出,不只是一次产品升级,更标志着算力基础设施已经从“支撑AI运行”,走向“驱动AI生产”。在AI规模化落地的背景下,该方案不仅将承载大模型的极致算力需求,更将成为驱动Token生产效率与产业智能跃迁的重要支点。
动态 2026-06-25
-
智谱开源 GLM-5.2 模型:1M 无损上下文,Code Arena 上全球可用模型排名靠前
的开源模型。其编程能力在主流基准上保持开源SOTA,与Claude Opus 4.8可比。此外,GLM-5.2实现了极致Infra优化,在1M上下文下将单位token的FLOPs降低至2.9倍,并可在国产算力平台上运行。
资讯 2026-06-17
-
清华系团队给大模型织了一张“智能算力电网”
AI芯片,正在机房里猛猛吃灰。
海外高端GPU供不应求、又贵又难买;
国产芯片产能好不容易上来了,结果是「能用但不好用」,生态不全、适配难、推理优化门槛高,大量国产卡就这么空转着,电费照烧,却产不出一颗能用的Token。
企业想用AI,偏偏卡在了最不该卡的环节,算力。
厂商动态 2026-06-05
-
智能体落地提速:高通CEO COMPUTEX重磅发声,从毫瓦到千瓦级设备全面赋能
中心”。智能体将重构硬件、芯片和OS,要求高能效算力、持续感知和分布式部署。高通还发布数据中心品牌DragonFly,完成从毫瓦到千瓦的全域算力布局。安蒙强调,6G将成为智能体时代的数字骨架,而Token成为AI新货币,分布式AI可节省60%消耗。分析师认为,高通正转型为端到端AI解决方案提供商。
资讯 2026-06-01
-
OpenAI GPT-5.6 模型曝下月发布:上下文窗口达 150 万 tokens,提升约 43%
token时仍可流畅响应,并能完美处理超105万tokens请求。其前端界面生成能力显著提升,可接近商用级。后端还发现ember-alpha和beacon-alpha版本。GPT-5.6有望于2026年6
资讯 2026-05-26
-
商汤发布日日新 SenseNova 6.7 Flash-Lite 多模态模型
商汤科技于5月8日发布日日新SenseNova 6.7 Flash-Lite多模态模型,并推出Token Plan限时免费使用政策,以降低开发者接入门槛。该模型是大模型系列的轻量版本,在保持多模态
资讯 2026-05-08
-
中康科技发布"营销3.0"理论体系与智能系统,推动医药行业迈入AI驱动新纪元
2025美思会重磅推出"Token为王+Agent协同"新范式,打造从理论到落地的一体化营销解决方案
资讯 2025-11-25