DeepSeek在自主药物研发基准评测中表现优于GPT-6 Sol
Raycaster AI发布的Biopharma-Bench基准评测结果显示,DeepSeek在自主药物研发相关任务中的表现超越了GPT-6 Sol。该内容源自Hacker News社区分享的评测链接,原始素材仅提供了基准测试地址与对比结论,未披露具体的实验参数、评测指标细节及完整报告,相关测试结论仍需进一步验证。
Raycaster AI发布的Biopharma-Bench基准评测结果显示,DeepSeek在自主药物研发相关任务中的表现超越了GPT-6 Sol。该内容源自Hacker News社区分享的评测链接,原始素材仅提供了基准测试地址与对比结论,未披露具体的实验参数、评测指标细节及完整报告,相关测试结论仍需进一步验证。
深度求索(DeepSeek AI)旗下智能体运行时框架 DeepSeek Harness 悄然上线官方桌面版开发者预览,版本号为 V0.1.7-rc.2。该桌面版免去了此前安装 Node.js 及终端运行的繁琐步骤,目前已支持 Windows x64 和 macOS Apple Silicon。应用内置标准模式、PTC 模式、极简模式和创造模式四种模式,支持智能体代码处理、批量调用工具和对话定制插件等功能。
GLM-5.3-Flash在同一模型架构中融合了Kimi的KDA线性注意力与DeepSeek的KPool-DSA稀疏注意力机制。这一架构创新表明,大模型底层Attention机制正经历演进,从以往不同机构各自独立押注的竞争性技术路线,转变为可在单一模型内按需分工、协同组合的模块化设计选项,为长文本处理与高效推理提供了新的工程实践范式。
DeepSeek Harness 现已推出桌面版本,该应用虽尚未获得官方正式宣布,但已通过苹果签名公证。桌面端目前仅支持 macOS 系统,内置了智能体团队、语音输入等 6 个功能插件,并提供标准、PTC、极简与创造四种专属工作模式,进一步拓展了相关工具在桌面端的生产力与多智能体协作场景。
该动态指出通过内核补齐与通信重构等优化手段,PCIe显卡在运行DeepSeek模型时的推理吞吐量提升了近7倍,并声称1.5台6000D设备的表现可超越1台B300。需要说明的是,素材提供的信息较为简短,缺少具体的软硬件环境、完整测试基准以及技术实现的深度细节。
本期早报汇总了多项科技动态:在人工智能领域,DeepSeek发布新论文并公开了Agent训练沙箱DSec;在消费电子与汽车出行方面,涵盖了蔚来ES9交付突破3万台以及多款数码硬件相关资讯。素材为快讯早报形式,内容较为简略杂糅,具体技术细节有待进一步展开。
根据相关资讯,OpenAI 推出了具有价格竞争力的新模型,直接对标并挑战 DeepSeek 此前建立的价格护城河,大模型领域的成本与定价竞争进一步加剧。鉴于原始提供素材的信息量较为有限,该模型的具体技术参数、架构细节及官方确切定价方案等核心内容暂未在摘要中详细展开。