谷歌发布多模态搜索模型 EmbeddingGemma 2
谷歌的 7.4 亿参数嵌入模型将文本、代码、图像、视频和音频映射到同一向量空间,采用面向本地设备的模块化编码器。
谷歌的 7.4 亿参数嵌入模型将文本、代码、图像、视频和音频映射到同一向量空间,采用面向本地设备的模块化编码器。
Mistral 已开放其万亿参数多模态模型的 API 访问,并将开放权重发布时间定在 10月27日。架构和基准测试方面的说法仍有待确认。
一篇预印本在视觉语言模型中发现了较早的物体匹配回路和较晚的关系匹配回路,并将后者与 ARC-AGI-1 的表现联系起来。
这个采用 Apache 许可的项目公开了加速器设计、编译器、模拟器和主机工具。实测吞吐量表明,这是受内存限制的小型系统,尚不足以替代 GPU。
一项预注册实验将九种 Claude Code 技能与等长的中性指令比较,发现两种成本低于安慰剂,一种表现更差,六种在统计上没有差别。
一项针对三个开放混合专家模型的技术研究发现,恶意软件问题的路由最接近道德问题,但模型可读取的工作空间仍保留安全概念。
研究、模型发布、本地项目、技术文章和社区报告:51 条简讯,均附直接来源。
这款 5010 亿参数混合专家模型目前只提供抢先体验。Reflection 称,权重、技术报告和开发者工具将在 10月晚些时候发布。
一篇预印本发现了一条共享的内部方向,将语言模型指向段落中的第一条、第二条或后续事实。沿该方向移动问题,可以改变模型检索到的事实。
一篇预印本发现,打乱智能体过去的行动后,历史记录的大部分收益仍然存在。明确配对每次行动及其结果,可以提高任务完成率。
这款开源命令行工具内嵌 llama.cpp,提供两个经过微调的小模型。作者还发布了包含 401,975 对样本的训练集和基准测试代码。
Context Language Models 用模型可重写、删除和重排的文件,替代只能追加的转录文本。作者报告,训练编辑策略后,长任务准确率更高,重复计算更少。