最近,商汤联合上海AI实验室等机构发布了大语言模型InternLM-123B。在全球51个评测集的测试中,它的12项成绩排名第一,综合实力位居全球第二,部分指标超越GPT-4。这主要得益于商汤在数据处理方面的强大能力,以及庞大的SenseCore算力基础。在技术迭代速度上,商汤也领先同行,半年时间就将InternLM-104B升级至123B。可以说,InternLM-123B的强劲表现拉近了中国与国外在大模型领域的差距。如果商汤能继续保持技术迭代的速度,很可能会成为首个达到GPT-4水平的国产大模型。
相关推荐
腾讯混元发布开源旗舰模型Hy4preview,总参数770B、上下文1M
腾讯混元8月28日发布开源旗舰大模型Hy4preview,总参数770B、激活参数49B,上下文1M,定位真实生产力。模型已开源至HuggingFace、GitHub、ModelScope等,并上线腾讯云TokenHub、OpenRouter,可在WorkBuddy/CodeBuddy、元宝、ima体验。其依托软工、游戏、金融、安全等领域专家数据共建,在四大方向取得进展。
2026年8月28号 14:29
312.1k
直出4K分辨率!谷歌全新Gemini Omni 1.1 Flash视频模型重磅登场
谷歌发布视频生成AI模型Gemini Omni1.1 Flash,最高支持4K超高清输出,并在场景扩展、运镜控制与生成效率上全面升级,面向开发者和专业创作者。该模型主打多项功能亮点,用户可直接进行场景扩展等操作,推动多模态视频生成向更高清、更长时方向演进。
2026年8月28号 9:10
270.8k
年砸百亿美元买大模型!Meta被曝重金押注Anthropic
Meta被曝内部预测每年在Anthropic AI模型上的支出最高或达100亿美元。Anthropic凭Claude系列在长文本处理、复杂逻辑推理及企业级应用生态构筑技术壁垒。这一潜在百亿美元级支出,折射出大模型军备竞赛正迎来更具想象力的资本博弈。
2026年8月28号 9:09
233.3k
千问办公首发上线Qwen3.8-Flash,Agent正式迈入“量大管饱”时代
千问办公平台上线Qwen3.8-Flash大模型及标准模式,全体用户可体验,具有更低积分消耗与更快Token吞吐优势。后续将形成标准与高级双模型体系,标准模式覆盖95%日常办公需求,剩余5%复杂任务由高级模式处理。
2026年8月27号 14:44
250.2k
通义千问发布Qwen3.8-Flash-Next,提前剧透Qwen4架构
阿里通义千问团队近日开源全新多模态MoE模型Qwen3.8-Flash-Next,作为Qwen4架构早期预览版。该模型采用高度稀疏的混合专家设计,总参数1250亿,另搭配510亿参数N-gram嵌入表和40亿参数多token预测模块,以极低计算开销实现越级性能表现。
2026年8月27号 13:53
233.2k
VIP会员