-
网易有道全线产品完成DeepSeek-V4-Flash正式版升级
。该版本与预览版结构一致,仅优化后训练,显著提升Agent能力。LobsterAI作为国内首个开源桌面办公助手,借助新模型降低Token消耗,GitHub Stars超5.7k,日均交互数十万次。有道
资讯 2026-08-03
-
小米MiMo-V2.5登顶OpenRouter全球双榜:国产模型调用量两月暴涨616%
小米MiMo-V2.5大模型在全球大模型调用量周榜和月榜上双双登顶,成为唯一突破10T Token的模型。自5月以来,其单周调用量从1.46T增长至10.46T,增速达616%。该模型在
资讯 2026-07-28
-
阿里预览Qwen3.8:2.4万亿参数大模型将至,预览版已上线
阿里巴巴通义千问团队于7月21日发布下一代大模型Qwen3.8,拥有2.4万亿参数,并确认将开源模型权重。预览版Qwen3.8-Max-Preview已通过阿里Token计划、Qoder和
资讯 2026-07-22
-
2026开放计算技术大会在京举行:解码AI基建新前沿,全球协作共促AIDC发展
7月9日,2026开放计算技术大会在北京举行。大会聚焦AI基建新前沿,围绕万亿参数大模型、多智能体协作带来的Token指数级增长,探讨如何以开放计算推动AI基础设施系统化创新,重点破解高速互连、供电架构、液冷散热、系统开放等技术瓶颈。
厂商动态 2026-07-10
-
直击大模型训推瓶颈 元脉发布AIGC存储网络解决方案
。近日,元脉网络锚定大模型训练、推理全流程需求,发布AIGC存储网络解决方案,助力企业夯实Token时代算力基础设施根基。
厂商动态 2026-07-01
-
为什么私有AI是更明智的赌注
公有云仍然很重要——特别是对于实验、突发性需求和精选服务。但对于许多生产工作负载来说,天平正在倾斜。随着Token成本上升、治理压力加剧,以及组织越来越擅长构建有针对性的模型而非默认使用巨型LLM,越来越多的企业将得出结论:他们最有价值的AI,应该留在离家更近的地方。
动态 2026-06-27
-
谷歌推出 DiffusionGemma 文本扩散模型:本地 AI 推理速度提升 4 倍
谷歌于6月11日发布DiffusionGemma,一种基于文本扩散机制的新型开放AI模型。该模型通过并行处理所有token并逐步去噪生成输出,较传统自回归模型在本地推理速度上提升4倍。自回归模型虽在
资讯 2026-06-11
-
从+AI到AI+奇点时刻来临,联想天禧AI 4.0全栈技术六大焕新升级发布开启AI+全新周期
,全球记忆力测试得分74.5%超越人类。同步推出联想AI主机P7,手掌大小却拥有190 TOPS算力,支持端边云一体化架构,实现80%Token本地处理。AI主机支持“一机双模”,可作家庭AI词元中心或
资讯 2026-05-20
-
应对异构芯片部署下的AI挑战,F5助企业推理服务更快、更省、更承压
随着人工智能(AI)大模型及智能体应用在企业端的全面落地,产业竞争的核心维度正发生深刻演变。据统计,截至2026年3月,中国日均词元(Token)调用量已超过140万亿,相比2024年初的1000亿
资讯 2026-04-29
-
阿里通义千问 Qwen3.5-Omni 全模态大模型发布
,支持100万token上下文,在Agent编程等场景表现突出。该系列产品标志着国产大模型在多模态和长上下文处理能力上的快速进步。
资讯 2026-03-31