登录社区云,与社区用户共同成长
邀请您加入社区
为遵守国家网络实名制规定,未绑定将限制内容发布与互动
Convai Innovations 开源了非自回归 System 1 决策模型 Laya。开源不到 2 天,Laya 已升至 HuggingFace 热门模型榜第三名,GitHub 获得 2.1k Stars。 Laya 是一款面向分类与决策任务的非自回归模型,主要用于从文本中快速识别类别、风险等级和处理优先级。它不需要像大语言模型一样逐字生成回答,而是直接输出判断结果及对应概率
Qwen 团队开源 Qwen-Image-2.1,将文生图与图像编辑统一在一个模型中。模型视觉生成部分仅 7B 参数,采用 32 层 Single-Stream DiT,在官方 Qwen-Image-Bench 公开评测中获得 60.28 分,并原生支持透明图生成与最多 10 张参考图编辑。 开源地址: 模型链接 https://modelscope.cn/models/Qwen/Qwen-Ima
近日,中电信人工智能科技有限公司正式发布 Xing4.0-29B-A4B——面向智能体时代的新一代星辰大模型。这是一款总参数量 29B、激活参数仅 4B 的 MoE 智能体大模型,原生支持 256K 上下文,可扩展至 512K,是国内首个基于国产算力与国产框架完成训练、面向复杂工程任务深度优化的百亿参数大模型。 作为新一代星辰大模型,Xing4.0 在 TeleChat1-3 系列基础上全面升级,
Prism ML由一支 Caltech 研究团队创立,长期研究"压缩神经网络而不牺牲推理能力";Ternary Bonsai 2 27B是继 7 月首代模型之后,开源的新一代三元多模态模型。它基于 Qwen3.8-27B 构建,权重被压到三值 {−1, 0, +1},体积 5.93GB(全精度为 53.80GB,约 1/9),在 20 项基准上平均 83.9 分,保留全精度基线
Viggle AI 开源几何引导视频模型 Meridian。该模型基于 MiniMax-H3,并通过 VGGT-Ω 从输入视频中提取深度、摄像机位姿等几何信息,可分别控制观察视角、摄像机路径与时间节奏。用户可以从已有视频或单张图像出发,对已发生的事件重新设计镜头,例如生成环绕运镜、变换观察角度,或在暂停、慢放过程中移动摄像机。Meridian 支持在单张 B200 GPU上完成推理。 模型下载:
紫东太初开源新一代面向物理世界的通用多模态大模型 ZDTaichu5.0-9B。它以 Qwen3.5-9B 为语言骨干、C-RADIOv4-H 为视觉骨干,参数量约 9B,支持文本、单图、多图与视频,最高 128K token 上下文和任意分辨率视觉输入。 依据九大国际权威空间理解基准横向评测结果: ZDTaichu5.0‑9B 为 10B 参数内空间具身能力最强的通用多模态大
一个模型发布了,有人第一时间跑起来,分享自己的尝试。有人接着问:我的电脑能用吗?能不能处理公司的资料?换成自己的数据,效果会怎么样? 有人带着问题继续摸索,也有人把解决过程写成教程,把代码、数据和踩过的坑一起留下来。 这些分享,有时是一篇长文,有时只是一条回复,却可能恰好帮另一个人跨过了卡住很久的地方。 社区里,这样的事情一直在发生。 9月1
上海人工智能实验室 Atria 团队发布 Atria Dawn Preview,一款面向科学研究、工程开发与专业工作流的智能体基础模型。该模型基于 7440 亿参数 MoE GLM-5.2 基座模型构建,支持 256K 上下文,重点解决开放任务中的持续环境理解、工具调用、多步骤执行与失败恢复。其可验证经验流水线将任务目标、智能体轨迹、中间产物和外部证据连接起来,让任务完成从“生成答案”推进到“产出
9月13日,在2026浦江创新论坛(第十九届)人工智能赋能科学研究专题论坛上,上海人工智能实验室(上海AI实验室)发布书生多模态大模型 S2(以下简称“书生-S2”)。重点提升了长程科研能力与智能体能力,并通过创新架构设计探索科学专业知识的持续扩展,为长周期科研任务提供更坚实的能力基础。 书生-S2在知识、代码、智能体等通用能力上达到了开源模型第一梯队,同时在Biology-Inst
NeuG v0.2.0 在事务一致性之上统一图遍历、向量检索和全文检索。三种检索共用一份数据,通过 Cypher 组合;代码以 Apache 2.0 开源。 请关注加星:https://github.com/alibaba/neug Agent 应用离不开检索,而检索有三种诉求 Agent 应用要检索的对象各不相同:私有文档、代码库、智能体的长期记忆,或是商品、工单、日志。但要做的事