MODEL-ZOO GPT-6 Astra 代码审查评测 最大的跃升出现在更困难的跨文件审查中,Astra 的收益达到 20% 超过 Sol,33% 超过 Opus 5。在客户规模上使用这种能力也意味着保护客户数据并评估模型的公共 API 定价。
MODEL-ZOO DeepSeek-V4-Flash-Vision-Exp DeepSeek-V4-Flash-Vision-Exp 的定位很明确:文本能力基本上保持在稳定版 V4-Flash 发布的水平(代理、推理、世界知识),而视觉是主要增量。
MODEL-ZOO Gemini 3.1: pro/flash-lite/live/tts Gemini 3.1不是一个带有四个营销名称的单一模型。它是一个路由图:为困难工作提供深度推理,为大批量任务提供低成本吞吐量。
MODEL-ZOO MOSS-Transcribe-Diarize MOSS-Transcribe-Diarize:一个0.9B的开源SOTA模型,一次处理转录、说话人分离、时间戳和声学事件——并在多个基准测试中超越大得多的专有AI系统。